Windows 本地运行 · 隐私安全

VisionGemma

完全本地的图片识别工具 + 趣味 AI 桌宠。傻瓜式部署,双击即用,可一键接入你的 AI 助手,图片识别全程在本机完成,不上传任何数据。

GitHub 下载 夸克网盘镜像 快速开始

产品截图

Agent 自动调起识别
🤖 Agent 自动调起识别AI 助手遇到图片时自动调用 VisionGemma,无缝获得看图能力
一键 MCP 对接
🔌 一键接入 AI 助手复制话术或配置 JSON,即可完成 MCP 对接,零手写配置
本地精准识别
🖼️ 本地精准识别产品图、截图、图表都能看懂,输出结构化描述
趣味 AI 桌宠
🐾 趣味 AI 桌宠桌面陪伴小宠物,支持对话、识别屏幕与图片

功能特性

🚀

傻瓜式部署

下载解压,双击运行,自动下载模型并完成配置,零命令行、零环境配置

🤖

Agent MCP 对接

可作为 MCP 服务器接入任意 AI 工具,一键引导复制即用,让 AI 获得看图能力

🔍

本地图片识别

图片分析、OCR 文字提取、图表解读、场景描述,全部在本机完成

Vulkan 加速

支持 NVIDIA / AMD / Intel 显卡硬件加速,无独显自动回退 CPU

🔒

隐私安全

所有识别完全离线本地完成,不上传任何数据到云端

📦

单文件免安装

一个 exe 即完整运行,内置 Vulkan 引擎与桌宠

快速开始

系统要求

  • Windows 10/11 x64
  • 显卡支持 Vulkan(NVIDIA / AMD / Intel 均可,推荐硬件加速)
  • 无独显时自动回退 CPU 运行
  • 磁盘剩余空间 ≥ 5GB(模型约 3.2GB)

安装步骤

  1. 解压压缩包,双击 VisionGemma-Vulkan.exe,首次运行自动打开配置向导
  2. 向导引导从 ModelScope 下载模型(约 3.2GB,支持断点续传)
  3. 下载完成后即可开始使用
安装包 SHA256:f1d61d205ed2308a0e2b9257f5775e7b1a2f75b45a126ca4af797ae5b2eb641c

一键接入你的 AI 助手

最简单的方式:打开软件的「对接引导」,点击「复制引导话术」,粘贴给你的 AI 助手即可自动完成配置。

也可以手动配置 MCP:

{
  "mcpServers": {
    "vision-gemma": {
      "command": "VisionGemma-Vulkan.exe 完整路径",
      "args": ["--mcp"],
      "type": "stdio"
    }
  }
}

然后即可调用 vision_analyze 工具识别图片。

趣味桌宠

  • 右键托盘图标 →「趣味桌宠」,快速启动桌宠,自动拉起本地识别引擎
  • 桌宠支持对话、选择主题等功能
  • 可通过托盘菜单设置开机自启

模型存放于 %LOCALAPPDATA%\VisionGemma\models