Skip to main content
Glama
q1023884985

vision-gemma

by q1023884985

VisionGemma - ローカル画像認識 + AI デスクトップペット

完全ローカルの Windows パソコンで動作する、すぐに使える画像認識ツール + 楽しい AI デスクトップペット。画像認識はすべてお使いの端末内で完結し、いかなるデータもアップロードされません。

製品紹介

🤖 Agent による自動起動認識

AI アシスタントが画像に遭遇したものの、画像入力に対応していない場合、VisionGemma が MCP ツールとして自動的に起動され、「画像を見る能力」をシームレスに引き継ぎます:

Agent による自動起動認識

🔌 AI アシスタントにワンクリック接続

設定ファイルを手書きする必要はありません。ソフトウェアに組み込まれた接続ガイドが、AI アシスタントに貼り付ける文言をコピーするか、設定 JSON を直接コピーするだけで、MCP 接続を完了できます:

ワンクリック MCP 接続

🖼️ ローカルでの高精度認識

画像を選択 → 認識 → 構造化された説明を取得、すべてオフラインで完了します。商品画像、スクリーンショット、グラフも理解できます:

ローカルでの高精度認識

🐾 楽しい AI デスクトップペット

デスクトップで寄り添う小さなペット。自然な会話、画面や画像の認識に対応:

楽しい AI デスクトップペット

Related MCP server: media-context-mcp

機能

  • かんたんデプロイ:ダウンロードして解凍し、ダブルクリックで実行するだけ。モデルを自動ダウンロードして設定を完了します。コマンドラインも環境設定も不要

  • Agent MCP 接続:MCP サーバーとして任意の AI ツール(\ision_analyze\ ツール)に接続でき、AI に画像を見る能力を与えます

  • ローカル画像認識:画像分析、OCR 文字起こし、グラフ解釈、シーン説明をすべて端末内で実行

  • Vulkan アクセラレーション:NVIDIA / AMD / Intel グラフィックカードのハードウェアアクセラレーションに対応。専用 GPU がない場合は自動的に CPU 実行にフォールバック

  • 楽しい AI デスクトップペット:トレイからかわいいペットを起動。会話、画面/画像の認識、対話によるお供が可能

  • プライバシーとセキュリティ:すべての認識は完全にオフラインでローカル実行され、いかなるデータもクラウドにアップロードしません

  • 単一ファイルでインストール不要:1 つの exe で完全に動作し、Vulkan エンジンとデスクトップペットを内蔵

システム要件

  • Windows 10/11 x64

  • Vulkan 対応グラフィックカード(NVIDIA / AMD / Intel いずれも可、ハードウェアアクセラレーション推奨)

  • 専用 GPU がない場合は自動的に CPU 実行にフォールバック

  • ディスク空き容量 >= 5GB(モデル約 3.2GB)

ダウンロード

GitHub Release(推奨)

Releases ページから v1.0.0 をダウンロード

インストーラ:VisionGemma-Vulkan.zip SHA256:\1DC26CB187923764C4CA03A8A852493081D123C9680B803FAE73CF560B640967

夸克网盘 ミラー(中国国内ユーザー向け高速化)

夸克网盘 から VisionGemma-Vulkan.zip をダウンロード

クイックスタート

  1. 圧縮ファイルを解凍し、VisionGemma-Vulkan.exe をダブルクリックします。初回起動時に設定ウィザードが自動的に開きます

  2. ウィザードがモデルを自動ダウンロードします(約 3.2GB、レジューム対応)

  3. ダウンロードが完了したら、すぐに使用を開始できます

デスクトップペット

  1. トレイアイコンを右クリック →「デスクトップペット」で、ペットをすばやく起動し、ローカル認識エンジンを自動的に起動します

  2. ペットは会話やテーマの選択などの機能に対応

  3. トレイメニューから自動起動を設定できます

MCP サーバーとして使用する(AI ツールに接続)

AI ツールの MCP 設定に次を追加します:

\\\json { "mcpServers": { "vision-gemma": { "command": "VisionGemma-Vulkan.exe 完整路径", "args": ["--mcp"], "type": "stdio" } } } \\

次に、\vision_analyze\ ツールを呼び出して画像を認識できます。より簡単な方法:ソフトウェアの「接続ガイド」を開き、文言をコピーして AI アシスタントに貼り付けるだけです。

ファイル構成

  • VisionGemma-Vulkan.exe メインプログラム(Vulkan エンジン + デスクトップペット内蔵、単一ファイルでインストール不要)

  • モデルは %LOCALAPPDATA%\VisionGemma\models に保存されます

プライバシーについて

すべての画像認識は完全にローカルで実行され、いかなるデータもアップロードされません

サポート

リンク

F
license - not found
Not graded
quality - not tested
A
maintenance

Maintenance

Maintainers
Response time
Release cycle
1Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

View all related MCP servers

Related MCP Connectors

  • OCR, transcription, file extraction, and image generation for AI agents via MCP.

  • A comprehensive Model Context Protocol (MCP) server that enables AI assistants to interact with yo…

  • Free OpenAI-compatible inference with signed provenance receipts and 3 focused MCP tools.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/q1023884985/visiongemma'

If you have feedback or need assistance with the MCP directory API, please join our Discord server