Skip to main content
Glama
q1023884985

vision-gemma

by q1023884985

VisionGemma - ローカル画像認識 + AI デスクトップペット

完全ローカルの Windows パソコンで動作する、すぐに使える画像認識ツール + 楽しい AI デスクトップペット。画像認識はすべてお使いの端末内で完結し、いかなるデータもアップロードされません。

製品紹介

🤖 Agent による自動起動認識

AI アシスタントが画像に遭遇したものの、画像入力に対応していない場合、VisionGemma が MCP ツールとして自動的に起動され、「画像を見る能力」をシームレスに引き継ぎます:

Agent による自動起動認識

🔌 AI アシスタントにワンクリック接続

設定ファイルを手書きする必要はありません。ソフトウェアに組み込まれた接続ガイドが、AI アシスタントに貼り付ける文言をコピーするか、設定 JSON を直接コピーするだけで、MCP 接続を完了できます:

ワンクリック MCP 接続

🖼️ ローカルでの高精度認識

画像を選択 → 認識 → 構造化された説明を取得、すべてオフラインで完了します。商品画像、スクリーンショット、グラフも理解できます:

ローカルでの高精度認識

🐾 楽しい AI デスクトップペット

デスクトップで寄り添う小さなペット。自然な会話、画面や画像の認識に対応:

楽しい AI デスクトップペット

Related MCP server: media-context-mcp

機能

  • かんたんデプロイ:ダウンロードして解凍し、ダブルクリックで実行するだけ。モデルを自動ダウンロードして設定を完了します。コマンドラインも環境設定も不要

  • Agent MCP 接続:MCP サーバーとして任意の AI ツール(\ision_analyze\ ツール)に接続でき、AI に画像を見る能力を与えます

  • ローカル画像認識:画像分析、OCR 文字起こし、グラフ解釈、シーン説明をすべて端末内で実行

  • Vulkan アクセラレーション:NVIDIA / AMD / Intel グラフィックカードのハードウェアアクセラレーションに対応。専用 GPU がない場合は自動的に CPU 実行にフォールバック

  • 楽しい AI デスクトップペット:トレイからかわいいペットを起動。会話、画面/画像の認識、対話によるお供が可能

  • プライバシーとセキュリティ:すべての認識は完全にオフラインでローカル実行され、いかなるデータもクラウドにアップロードしません

  • 単一ファイルでインストール不要:1 つの exe で完全に動作し、Vulkan エンジンとデスクトップペットを内蔵

システム要件

  • Windows 10/11 x64

  • Vulkan 対応グラフィックカード(NVIDIA / AMD / Intel いずれも可、ハードウェアアクセラレーション推奨)

  • 専用 GPU がない場合は自動的に CPU 実行にフォールバック

  • ディスク空き容量 >= 5GB(モデル約 3.2GB)

ダウンロード

GitHub Release(推奨)

Releases ページから v1.0.0 をダウンロード

インストーラ:VisionGemma-Vulkan.zip SHA256:\1DC26CB187923764C4CA03A8A852493081D123C9680B803FAE73CF560B640967

夸克网盘 ミラー(中国国内ユーザー向け高速化)

夸克网盘 から VisionGemma-Vulkan.zip をダウンロード

クイックスタート

  1. 圧縮ファイルを解凍し、VisionGemma-Vulkan.exe をダブルクリックします。初回起動時に設定ウィザードが自動的に開きます

  2. ウィザードがモデルを自動ダウンロードします(約 3.2GB、レジューム対応)

  3. ダウンロードが完了したら、すぐに使用を開始できます

デスクトップペット

  1. トレイアイコンを右クリック →「デスクトップペット」で、ペットをすばやく起動し、ローカル認識エンジンを自動的に起動します

  2. ペットは会話やテーマの選択などの機能に対応

  3. トレイメニューから自動起動を設定できます

MCP サーバーとして使用する(AI ツールに接続)

AI ツールの MCP 設定に次を追加します:

\\\json { "mcpServers": { "vision-gemma": { "command": "VisionGemma-Vulkan.exe 完整路径", "args": ["--mcp"], "type": "stdio" } } } \\

次に、\vision_analyze\ ツールを呼び出して画像を認識できます。より簡単な方法:ソフトウェアの「接続ガイド」を開き、文言をコピーして AI アシスタントに貼り付けるだけです。

ファイル構成

  • VisionGemma-Vulkan.exe メインプログラム(Vulkan エンジン + デスクトップペット内蔵、単一ファイルでインストール不要)

  • モデルは %LOCALAPPDATA%\VisionGemma\models に保存されます

プライバシーについて

すべての画像認識は完全にローカルで実行され、いかなるデータもアップロードされません。

サポート

リンク

Related MCP Connectors

Related MCP Servers