opencode-eyes-nvidia
opencode-eyes-nvidia 👁️
MCP-Server, der Bildbeschreibungsfunktionen über die gehostete NVIDIA-NIM-API
(https://integrate.api.nvidia.com/v1) mit dem multimodalen Modell MiniMax-M3 bereitstellt.
Bietet Modellen ohne multimodale Fähigkeiten „Augen". Gib ein Bild ein und erhalte eine detaillierte textuelle Beschreibung des Bildes.
Funktionen
Werkzeug | Beschreibung |
| Beschreibt den Inhalt eines Bildes, standardmäßig mit dem multimodalen Modell MiniMax-M3 |
| Listet die auf der NVIDIA-NIM-API verfügbaren multimodalen (visuellen) Modelle auf |
Related MCP server: vision-mcp
Multimodale Modelle
Das Standardmodell ist minimaxai/minimax-m3 (Text/Bild/Video-Eingabe → Text-Ausgabe, 1M Kontext, unterstützt Reasoning).
Es kann über NVIDIA_MODEL oder den Parameter model von describe_image gewechselt werden:
Modell-ID | Beschreibung |
| MiniMax-M3 multimodales MoE-VLM (Standard, unterstützt Bild/Video) |
| Meta Llama 3.2 11B Vision |
| Meta Llama 3.2 90B Vision |
| NVIDIA Nemotron Nano VL 8B |
| Google Gemma 3 27B IT |
| NVIDIA Nemotron Nano 12B v2 VL |
| Qwen 3.5 397B A17B VLM |
Umgebungsvariablen
Variable | Erforderlich | Standardwert | Beschreibung |
| Nein* | — | Ein einzelner NVIDIA-API-Key (erhältlich unter https://build.nvidia.com, |
| Nein* | — | Mehrere Keys, getrennt durch Komma / Semikolon / Leerzeichen / Zeilenumbruch |
| Nein* | — | Nummerierte Keys, werden ab |
| Nein |
| Basis-URL der API |
| Nein |
| Standardmäßig verwendetes multimodales Modell |
| Nein |
| API-Request-Timeout (Sekunden) |
| Nein |
| Die längste Seite des Bildes wird vor dem Senden auf diese Pixelzahl skaliert, 0 bedeutet keine Skalierung |
| Nein |
| JPEG-Komprimierungsqualität vor dem Senden (0-100) |
| Nein | (leer) | MiniMax-M3-Reasoning-Modus: |
| Nein | Anzahl der Keys | Gesamtzahl der Rotationsversuche (über alle Keys hinweg) |
| Nein |
| Sekunden, die nach jedem Fehler gewartet werden (Warten auf Quoten-Refresh) |
* Es muss mindestens ein Key konfiguriert sein: NVIDIA_API_KEY, NVIDIA_API_KEYS oder NVIDIA_API_KEY_1..N – einer davon genügt, mehrere können gleichzeitig konfiguriert werden (dedupliziert zusammengeführt).
Key-Rotation (automatischer Wechsel zwischen mehreren Keys)
Unterstützt die Konfiguration mehrerer API-Keys: Requests werden der Reihe nach verarbeitet, bei Fehlern wird automatisch zum nächsten Key gewechselt, der ursprüngliche Key wird nicht gelöscht, sondern nur ans Ende der Warteschlange gestellt, bis sein Quotenlimit sich erneuert hat. Automatische Wiederholungsversuche während des gesamten Prozesses, kein manueller Eingriff erforderlich.
So funktioniert es:
Beim Start werden alle Keys in einer Warteschlange zusammengeführt (dedupliziert, in der Reihenfolge
NVIDIA_API_KEY→NVIDIA_API_KEYS→NVIDIA_API_KEY_1..N).Requests verwenden standardmäßig den Key am Anfang der Warteschlange.
Bei wiederholbaren Fehlern (HTTP
401 / 403 / 404 / 408 / 429 / 5xxoder Verbindungs-Timeout): Der Key am Anfang wird ans Ende verschoben, nachNVIDIA_ROTATION_BACKOFFSekunden wird mit dem nächsten Key erneut versucht.Erst wenn alle Keys durchlaufen wurden (insgesamt
NVIDIA_ROTATION_MAX_RETRIESVersuche) und immer noch kein Erfolg erzielt wurde, wird der letzte Fehler ausgelöst.Der Warteschlangenstatus bleibt über mehrere Aufrufe hinweg erhalten – gedrosselte Keys stehen weiter hinten und ihre Quote ist beim nächsten Durchlauf meist bereits erneuert.
Beispiel:
# 方式一:逗号分隔多个 Key
set NVIDIA_API_KEYS=nvapi-key-1,nvapi-key-2,nvapi-key-3
# 方式二:编号 Key
set NVIDIA_API_KEY_1=nvapi-key-1
set NVIDIA_API_KEY_2=nvapi-key-2
# 方式三:单个 Key(向后兼容)
set NVIDIA_API_KEY=nvapi-key-1Übergib die Umgebungsvariablen in der OpenCode-Konfiguration an den MCP-Dienst:
{
"mcp": {
"opencode-eyes-nvidia": {
"type": "local",
"command": ["python", "-m", "opencode_eyes_nvidia"],
"enabled": true,
"timeout": 120000,
"environment": {
"NVIDIA_API_KEYS": "{env:NVIDIA_API_KEYS}"
}
}
}
}Installation
pip install -r requirements.txtOder als Paket installieren:
pip install .Ausführen
# 设置环境变量(Windows,至少一种)
set NVIDIA_API_KEY=nvapi-你的key
# 或 set NVIDIA_API_KEYS=nvapi-key-1,nvapi-key-2
# 启动服务
python -m opencode_eyes_nvidiaIn OpenCode konfigurieren
{
"mcp": {
"opencode-eyes-nvidia": {
"type": "local",
"command": ["python", "-m", "opencode_eyes_nvidia"],
"enabled": true,
"timeout": 120000,
"environment": {
"NVIDIA_API_KEYS": "{env:NVIDIA_API_KEYS}",
"NVIDIA_API_KEY": "{env:NVIDIA_API_KEY}"
}
}
}
}Manueller Test
Ohne opencode zu starten, direkt über stdio verifizieren:
$env:NVIDIA_API_KEY = "nvapi-xxx"
python -m opencode_eyes_nvidiaDann in einem anderen Terminal eine MCP-JSON-RPC-Nachricht senden, zum Beispiel:
{"jsonrpc":"2.0","id":1,"method":"initialize","params":{"protocolVersion":"2024-11-05","capabilities":{},"clientInfo":{"name":"test","version":"0.0.0"}}}
{"jsonrpc":"2.0","id":2,"method":"tools/list"}
{"jsonrpc":"2.0","id":3,"method":"tools/call","params":{"name":"describe_image","arguments":{"image_path":"C:/path/to/photo.jpg"}}}Unterschiede zu opencode-eyes
API von StepFun auf NVIDIA NIM umgestellt (
https://integrate.api.nvidia.com/v1)Standardmodell von
step-3.7-flashauf MiniMax-M3 umgestellt (minimaxai/minimax-m3)Neues Tool
list_vision_modelsund Fähigkeit zum Wechseln zwischen mehreren Modellen hinzugefügtUnterstützt die
thinking_mode-Reasoning-Steuerung von MiniMax-M3Unterstützt Rotation über mehrere API-Keys: Bei Fehlern wird automatisch zum nächsten Key gewechselt, der ursprüngliche Key wird ans Ende der Warteschlange gestellt und wartet auf die Quoten-Erneuerung
Lizenz
MIT
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- FlicenseNot gradedqualityBmaintenanceA versatile MCP server that adds vision capabilities (image analysis, OCR, image/video generation) to AI models lacking native vision, with support for multiple providers and automatic task routing.1
- AlicenseNot gradedqualityCmaintenanceMCP server for analyzing images using multiple vision LLM providers (OpenCode, OpenAI, Anthropic, Google, and custom OpenAI-compatible endpoints). Provides tools to analyze single or multiple images, list providers, and test vision capabilities.MIT
- AlicenseAqualityAmaintenanceMCP server that gives text-only AI agents the ability to understand images via vision tools, including multi-image analysis, OCR, comparison, and structured extraction. It uses providers like OpenAI, Anthropic, Gemini, and OpenRouter to return plain text descriptions.410121MIT
- AlicenseNot gradedqualityCmaintenanceMCP server that provides visual question answering, image description, object detection, OCR, and image manipulation tools using OpenAI-compatible vision models.GPL 2.0
Related MCP Connectors
MCP server for MiniMax H3 multimodal video generation
MCP server providing access to the Scorecard API to evaluate and optimize LLM systems.
MCP server for Google Veo AI video generation
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/bauerelizabeth07139/opencode-eyes-nvidia'
If you have feedback or need assistance with the MCP directory API, please join our Discord server