Gemini Image MCP
Gemini Image MCP

Un servidor MCP para generar y editar
imágenes con los modelos de imagen Gemini de Google (Nano Banana, Nano Banana 2, Nano
Banana Pro). Expone una herramienta, generate_image, que herramientas de IA como Claude,
Codex y Cline pueden llamar usando tu propia clave API.
Qué hace
generate_imagemaneja texto a imagen, además de edición y composición cuando le pasas imágenes de referencia (rutas de archivo locales o base64).Cada parámetro de generación se expone por llamada:
temperature(1),topP(0.95),topK,maxOutputTokens(65536 para flash/lite, 32768 para pro),seed,stopSequences,presencePenalty,frequencyPenalty,systemInstruction,thinkingLevel(minimal/high),thinkingBudget,enableGoogleSearch(por defecto true),imageSize(512/1K/2K/4K),aspectRatio("auto" por defecto + relaciones estándar),personGeneration.Incluye un bloque
instructionsy descripciones por parámetro, para que los clientes MCP sepan cómo usar la herramienta sin necesidad de indicaciones adicionales.Guarda las imágenes en disco y devuelve las rutas de archivo. Sin base64 en la respuesta, así que una imagen 4K no consumirá la ventana de contexto del cliente.
Los errores llegan con pistas (clave incorrecta, límite de velocidad, bloqueo de seguridad, modelo desconocido) en lugar de un volcado de API sin procesar.
Transporte stdio, la configuración habitual para servidores MCP locales.
Related MCP server: Nano-Banana MCP Server
Requisitos
Bun 1.0+
Una clave API de Gemini desde https://aistudio.google.com/apikey
Instalar
bun installConfiguración
Tres variables de entorno, normalmente establecidas en la configuración del cliente MCP:
Variable | Obligatoria | Por defecto | Qué hace |
| Sí (o | Tu clave API de Gemini. Si ambas están configuradas, | |
| No |
| Modelo utilizado cuando una llamada no especifica uno. |
| No |
| Donde se guardan las imágenes. Se crea si no existe. |
Modelos que puedes elegir:
Modelo | Máximo de tokens de salida | Nivel de pensamiento | Búsqueda de Google | Tamaño máximo | Notas |
| 65536 | minimal / high | Compatible | 2K | Nano Banana 2. Rápido, económico, de uso general. El predeterminado. |
| 65536 | minimal / high | Compatible | 2K | Modelo ligero y de alto rendimiento. |
| 32768 | (ninguno) | Compatible | 4K | Nano Banana Pro. Mejor calidad y texto en imagen, y el único que hace 4K. |
Los modelos también se pueden especificar con el prefijo models/ (por ejemplo,
models/gemini-3.1-flash-image).
Configuración del cliente
Claude Desktop
Añade esto a ~/Library/Application Support/Claude/claude_desktop_config.json:
{
"mcpServers": {
"gemini-image": {
"command": "bun",
"args": ["run", "/absolute/path/to/gemini-image-mcp/index.ts"],
"env": {
"GEMINI_API_KEY": "YOUR_KEY_HERE"
}
}
}
}Cline (VS Code)
cline_mcp_settings.json:
{
"mcpServers": {
"gemini-image": {
"command": "bun",
"args": ["run", "/absolute/path/to/gemini-image-mcp/index.ts"],
"env": {
"GEMINI_API_KEY": "YOUR_KEY_HERE"
}
}
}
}Codex
~/.codex/config.toml:
[mcp_servers.gemini-image]
command = "bun"
args = ["run", "/absolute/path/to/gemini-image-mcp/index.ts"]
env = { GEMINI_API_KEY = "YOUR_KEY_HERE" }Desde npm (bunx/npx)
Una vez que el paquete esté publicado, apunta tu cliente a bunx en su lugar:
{
"mcpServers": {
"gemini-image": {
"command": "bunx",
"args": ["gemini-image-mcp"],
"env": { "GEMINI_API_KEY": "YOUR_KEY_HERE" }
}
}
}Parámetros de generate_image
Solo prompt es obligatorio. Todo lo demás se predetermina a algo sensato para la
generación de imágenes.
Parámetro | Tipo | Por defecto | Descripción |
| string | — (obligatorio) | Descripción narrativa de la imagen, o de la edición cuando se proporcionan |
| string | env / | Modelo de imagen Gemini (ver tabla arriba). Acepta el prefijo |
| array (≤14) | — | Imágenes de origen para edición/composición: |
|
|
| Resolución de salida: 512 (más rápida, ligera), 1K (predeterminada), 2K, 4K (requiere |
| enum |
|
|
| enum |
|
|
| enum |
|
|
| boolean |
| Habilita la herramienta de fundamentación de Búsqueda de Google para conocimiento web en tiempo real y precisión en todos los modelos. |
| int | — | Presupuesto de pensamiento explícito (0 = desactivado, -1 = automático). |
| number 0–2 |
| Aleatoriedad del muestreo. |
| number 0–1 |
| Muestreo de núcleo. |
| int | — | Muestreo top-k. |
| int 1–65536 | 65536 (flash) / 32768 (pro) | Límite de tokens de salida. |
| int | — | Reproducibilidad de mejor esfuerzo. |
| string( ≤5) | — | Secuencias de parada para la parte de texto. |
| number -2..2 | — | Penalizaciones de tokens. |
| string | — | Dirección de estilo/comportamiento, por ejemplo, "estilo vectorial plano". |
| string | env / | Donde guardar. |
| string |
| Nombre base del archivo (extensión automática según el tipo MIME). |
La herramienta devuelve un resumen de texto con las rutas de archivo guardadas, el modelo, la configuración efectiva y el uso de tokens. Nunca devuelve datos de imagen en línea; abre el archivo para ver el resultado.
Cosas que puedes pedirle a tu IA
"Genera una imagen heroica 16:9 de una calle lluviosa de Tokio por la noche, con iluminación neón cinematográfica."
"Edita
/tmp/product.png: ponlo sobre una mesa de mármol con luz suave de la mañana" (esto usareferenceImages)."Genera un póster 4K con el título exacto 'LAUNCH DAY' usando gemini-3-pro-image."
Desarrollo
bun test # unit tests (config, schema, request/response parsing)
bun run typecheck # tsc --noEmit
bun run inspector # interactive MCP inspector (needs GEMINI_API_KEY)
bun run start # run the server on stdioSolución de problemas
"Falta la clave API de Gemini": pon
GEMINI_API_KEYen el bloqueenvde la configuración MCP del cliente. Configurarla en tu shell no es suficiente para aplicaciones GUI como Claude Desktop, ya que no leen tu entorno de shell.Bloqueos de seguridad: reformula la prompt. Si hay personas involucradas, comprueba
personGeneration.429 / cuota excedida: espera y vuelve a intentarlo, o quédate con
gemini-3.1-flash-image, que tiene la cuota más alta.Registros: el servidor escribe registros solo en stderr. stdout transporta el protocolo MCP, así que no añadas
console.logen ningún lugar.
Autor
Thomi Jasir dev@venobi.com
Licencia
MIT
This server cannot be deployed
Maintenance
Related MCP Connectors
MCP server for Qwen Image 3 AI image generation
MCP server for NanoBanana AI image generation and editing
Generate AI images and videos from any compatible MCP client.
Focused MCP server for OpenAI image/audio generation (v2.0.0). Wraps endpoints via HAPI CLI.
Related MCP Servers
- AlicenseBqualityCmaintenanceAn MCP server for image generation using the Gemini API.137 npm2MIT
- AlicenseAqualityDmaintenanceAn MCP server that provides AI image generation and editing capabilities using Google's Gemini 2.5 Flash Image API. It allows users to create new images from text, modify existing files, and perform iterative edits through natural language prompts.61,220 npmMIT
- AlicenseAqualityDmaintenanceMCP server for Google Gemini image generation with configurable model support, enabling text-to-image generation, image editing, and iterative refinement.640MIT
- FlicenseAqualityDmaintenanceWraps Google Gemini's image generation API as an MCP server, enabling text-to-image, image editing, and grounded search workflows from any MCP client.2-