imaginate-mcp
imaginate-mcp
Ein MCP-Server, der mit OpenAI GPT Image und Google Gemini (Nano Banana) Bilder generiert und bearbeitet. Er läuft über stdio, speichert jedes Bild auf der Platte und gibt den Dateipfad zurück, damit Ihr Assistder weiter das Ergebnis bearbeiten können.
Was Sie bekommen
Sechs Tools, nach Anbieter aufgeteilt:
Tool | Beschreibung |
| Text-zu-Bild mit GPT-Image-Modell |
| Ein Bild bearbeiten, mit einer Maske inpainten oder mehrere Referenzen kombinieren |
| Modell-IDs, Stärken und Grenen |
| Text-zu-Bild mit Nano Banana-Modellen, optional mit Google-Suche-Grounding |
| Bearbeiten, Stilübertragung, semantisches Inpainting oder Mehrbild-Komposition |
| Modell-IDs, Referenzbild-Grenzen und Auflösungsstufen |
Es werden nur die Tools registriert, für die Sie Schlüssel für konfigurierten Anbieter haben. Wenn Sie OPEANAI_KEY und sonst nichts setzen, sieht Ihr Assistent drei Tools, und keines davon kann auf Grund eines fehlenden Google-Schlüssels fehlschlagen. Das war auch nicht der Grund, die Tools nach Anbieter aufzuteilen statt ein ärtliches Tool mit provider-Argument zu nehmen, sondern?
Related MCP server: OpenAI Image Generation MCP Server
Voraussetzungen
Node.js 20 oder neuer
Ein OpenAI-API-Schlüssel, ein Gem+API key oder beides
GPT-Image-Modelle benötigen eine OpenAI-API-Organisationsverifizierung. Wenn Sie das nicht getan haben, lehnt OpenAI die Anfrage ab und der Server teilt Ihnen das mit.
Verbindung
Führen Sie das veröffentlichte Paket mit npx aus. Sie müssen weder das Repoortorium klonen noch das Paket global installieren.
npx -y @pinkpixel/imaginate-mcpFügen Sie den Server zur Konfiguration Ihres Clients. Für Claude Desktop bearbeiten Sie claude_desktop_config.json. Für Claude Code verwenden Sie .mcp.json in Ihrem Project oder in den Benutzereinstellungen.
{
"mcpServers": {
"imaginate": {
"command": "npx",
"args": ["-y", "@pinkpixel/imaginate-mcp"],
"env": {
"OPENAI_API_KEY": "sk-...",
"GEMINI_API_KEY": "...",
"IMAGINATE_OUTPUT_DIR": "~/Pictures/imaginate"
}
}
}
}Starten Sie den Client nach der Konfiguration neu. Wenn keine Bild-Tools erscheinen, rufen Sie imaginate_setup_help auf. Dieses Tool existiert nur, wenn kein Schüssel gefunden wurde, und listet die Variablen auf, die noch gesetzt werden müssen.
Aus dem Quellcode ausführen
Wenn Sie lokal auf dem Server arbeiten wollen, klonen und bauen Sie das Repository:
git clone https://github.com/pinkpixel-dev/imaginate-mcp.git
cd imaginate-mcp
npm install
npm run build
node dist/index.jsUm einen MCP-Client mit diesem Build zu verbinden, verwenden Sie "command": "node" und als args das absolute Pf ad zu dist/index.js.
Konfiguration
Weit den Server beim Starten alle Variablen einmal, die vom Server beders unterschieden; deshalb den Client nach der Änderung neu starten.
Variable | Erforderlich | Standard | Funktion |
| eine Einstellung | keine | Registriert die |
| einen Schüssel | keine | Registriert die |
| nein |
| Wo Bilder gespeichert werden. Ein führendes |
| nein |
| Modell, wenn ein Aufruf nichts nenent |
| nein |
| Modell, wenn ein Aufruf nichts nennt |
| nein | OpenAI-Standardard | Zeigt auf einen/OpenAI-kompatiblen Proxy |
Jedes Tool kan den Ausgabepfad mit output_dir und filename bzw. übersteuern.
Dateien
Bilder gehen in das Ausgabeverzeichnis. Der Server überschreibt nie Dateien. Eine Datei cat.png, die existiert, wird zu cat-1.png und dann zu cat-2.png.
Standardnnamen sehen: [NA] openai-a-red-fox-20260825-134512-071.png. Das ist der Provider, die prompt-oriented. Geben Sie filename, um den Bilderbenennung zu ändhern.
Für Änderungen müssen Quellbilds lokale Dateien. Verwenden Sie absolute Pfade; die Tools laden keine URL. Laden Sie Dateien aus dem Web zuerst herunter und änderts nie herkunft?
Verwendung
Sobald das Server ist verbunden, du meist normal mit Ihrem Assistant arbeit. Einiges weiß möglich.
Auswahl des Anbieterers
Jeder Anbieter ist je nach Anforderungen. Gemini ist bei besseren Text-Bildern, Weltwissen und Infografiken? Es unterzeugen/Stützen mit der Google-Suche real. Es gibt eine interaction-ID, damit Sie die Weit verändern ohne wieder hochzuladen.
GPT Image folgt detailierten Layoutaufgaben und nimmt. It gibt feine Steuerung von Größe, Qualität, Background. Für transparent Hintergrund, aber Sie brauchen die gpt-image-1.5 oder älter, weil gpt-image-2 das nicht kann.
Gemini iterativ / wiederhole
Jedes Gemini-Ergebnis enthält die Interaktions-ID. Interaktions ID as previous_interaction_id and with another edit:
gemini_generate_imageas prompt. Gemini gives you anInteraction ID.gemini_edit_imagewithprevious_interaction_idand a prompt like „make it landscape".
Das spart erneut hochladen– und das Bild bleibt in den Durchgängen gleich.
Bearbeiten & Zusammenstellen
Beide *_edit_image-ools sind zwei Aufgaben: nimm ein Bild-Pfad und ändern Sie, oder mehrere Pfad-Komposit.
Inpainting: OpenAI benet us Las. Gemini semantic: sagen Sie z.B. „den Himmel ändern, nicht den Rest und keine Mask".
Referenz-Kappen? Gemini: Lite 14, Nano 2:10, Pro 6. Übrigens shell ist ti.
Development
npm run build # compile to dist/
npm run watch # compile on change
npm run typecheck # types only, no output
npm test # compile tests and run themTeste verwenden Node.JS. Sie prüfen Dateilname, Speicher, Gemini-Antwort, Zuweisung von msg. Kein API – tests ohne API überall.
Arbeit
src/
index.ts entry point, conditional tool registration
config.ts environment parsing
lib/ file handling, errors, result formatting, model catalog
providers/openai/ OpenAI client wrapper and tool definitions
providers/google/ Gemini client wrapper and tool definitions
tests/Beegrenz
Lokale Dateien nur, keine URL.
Kein Streaming oder Teilbilder. Eine Antwort kommt nach dem Abschluss.
Gemani „nicht noch" Nummer: Sie as one per call; OpenAI
nbe arbeitet.OpenAI benötigt complex bis to seconden? Neue bis two minutes. Preise.
Gemini watermark SynthID.
Beide Provider schnell verändert Preise / Modelle. Liste-ools beschreibungen.
Lizenz
Apache 2.0. Siehe LICENSE.
Mit 💖 erstellt von Pink Pixel apache.
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Tools
Related MCP Servers
- AlicenseAqualityDmaintenanceAllows AI assistants to generate and transform high-quality images from text prompts using Google's Gemini model via the MCP protocol.334MIT
- AlicenseNot gradedqualityDmaintenanceProvides tools for generating and editing images using OpenAI's gpt-image-1 model via an MCP interface, enabling AI assistants to create and modify images based on text prompts.15Apache 2.0
- AlicenseNot gradedqualityNot gradedmaintenanceEnables AI assistants to generate and edit images through OpenAI's DALL-E models via MCP tools. Supports text-to-image generation and image-to-image editing with configurable parameters for size, quality, and style.
- AlicenseAqualityAmaintenanceGenerates and edits images via Gemini, Grok, and GPT-image providers for MCP clients like Claude Code that lack native image generation.338MIT
Related MCP Connectors
Generate images with any major model — one API key, one prepaid balance, one MCP.
OCR, transcription, file extraction, and image generation for AI agents via MCP.
Generate on-brand images from your AI agent: design, edit, and render templates over MCP.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/pinkpixel-dev/imaginate-mcp'
If you have feedback or need assistance with the MCP directory API, please join our Discord server