Gemini Omni MCP Server
Gemini Omni 1.1 Flash API — Envoltorio de Python
Un SDK de Python y un servidor MCP centrados en Google Gemini Omni Flash on MuAPI. Admite text-to-video, image-to-video, video-edit, perfiles de voz reutilizables, perfiles de personaje reutilizables y sondeo asíncrono de trabajos.
Google anunció la actualización Gemini Omni 1.1 Flash el 27 de agosto de 2026 — que añade extensión de escena (hasta 10 segundos de contexto analizado, hasta 40 segundos de duración acumulada), control de fotogramas clave del primer/último fotograma, un modo de resolución de borrador de 360p, mejora de escala a 4K y hasta 3 segundos de entrada de vídeo de referencia. Consulta muapi.ai/gemini-omni-1.1-flash para más detalles. Este cliente envuelve los endpoints de Gemini Omni Flash que están activos hoy en MuAPI; los controles específicos de la 1.1 mencionados arriba se están implementando gradualmente y aún no están expuestos por este SDK — este README y el código se actualizarán a medida que MuAPI los añada.
Proyectos relacionados
Gemini Omni on MuAPI — Página de inicio del modelo: text-to-video, image-to-video, video-edit, perfiles de voz, perfiles de personaje.
Gemini Omni 1.1 Flash on MuAPI — Novedades de la actualización 1.1 y estado de implementación.
gemini-omni-comfyui — Nodos personalizados de ComfyUI para Gemini Omni a través de MuAPI.
Awesome-Gemini-Omni-API-Prompts — Biblioteca seleccionada de prompts de Gemini Omni y guía de API.
awesome-ai-video-models — Compara modelos de vídeo con IA por API, precio y velocidad.
Wan-3.0-API — SDK de Python para generación de vídeo Wan 3.0 a través de MuAPI.
Veo-4-API — SDK de Python para generación de vídeo con Google Veo AI.
Seedance-2-API — SDK de Python para generación de vídeo con ByteDance Seedance.
Generative-Media-Skills — Habilidades listas para agentes para flujos de trabajo multimedia automatizados.
muapi-cli — Acceso desde línea de comandos a los modelos de imagen, vídeo y audio de MuAPI.
Related MCP server: PixVerse MCP
Instalación
git clone https://github.com/Anil-matcha/Gemini-Omni-1.1-Flash-API.git
cd Gemini-Omni-1.1-Flash-API
pip install -r requirements.txt
cp .env.example .envConfigura MUAPI_API_KEY en .env. Configura GEMINI_OMNI_API_BASE_URL solo si utilizas un proveedor compatible distinto de la URL base predeterminada de MuAPI.
Inicio rápido
from gemini_omni_api import GeminiOmniAPI
api = GeminiOmniAPI()
job = api.text_to_video(
"A street musician plays a violin on a rainy Paris evening, raindrops tap "
"the cobblestones, a slow melancholic melody, distant café chatter.",
duration=8,
resolution="1080p",
aspect_ratio="16:9",
)
result = api.wait_for_completion(job["request_id"])
print(result)De imagen a vídeo
job = api.image_to_video(
prompt="The subject slowly turns to face the camera as golden-hour light sweeps across the scene.",
image_urls=["https://example.com/reference.jpg"],
aspect_ratio="9:16",
duration=8,
)Edición de vídeo
job = api.video_edit(
prompt="Restyle the entire clip as a hand-drawn Studio Ghibli animation, keep the original camera motion.",
video_url="https://example.com/source.mp4",
trim_start=0,
trim_end=10,
resolution="1080p",
)Perfiles de voz y de personaje
voice = api.create_audio_profile("Narrator", preset_voice="warm-male-1", style_description="calm, deliberate pacing")
character = api.create_character_profile("Host", image_url="https://example.com/host.jpg")
job = api.text_to_video(
"The host welcomes viewers to the show.",
audio_ids=[voice["audioId"]],
character_ids=[character["characterId"]],
)Superficie de la API
Método | Propósito |
| Genera un vídeo con audio sincronizado a partir de un prompt de texto. |
| Anima de 1 a 7 imágenes de referencia con un prompt de texto. |
| Reestiliza, reilumina, intercambia sujetos o reescribe el diálogo a partir de un clip de origen. |
| Crea un perfil de voz reutilizable a partir de una voz predefinida; devuelve un |
| Crea un perfil de personaje reutilizable a partir de una imagen de referencia; devuelve un |
| Sube un archivo de referencia local. |
| Recupera la salida de un trabajo asíncrono. |
text_to_video(), image_to_video() y video_edit() aceptan duration (4/6/8/10 segundos), resolution (720p, 1080p, 4k), aspect_ratio (16:9, 9:16), hasta 3 audio_ids, hasta 3 character_ids y seed.
Servidor MCP
Expone las herramientas de Gemini Omni a clientes compatibles con MCP:
python mcp_server.pyEl servidor proporciona las herramientas text_to_video, image_to_video, video_edit, create_audio_profile, create_character_profile y get_task_status.
Estado: implementación gradual de la actualización 1.1
Google anunció Gemini Omni 1.1 Flash el 27 de agosto de 2026. Actualmente se está implementando a través de Google AI Studio, la plataforma Gemini Enterprise Agent, Google Flow y la aplicación Gemini. MuAPI está implementando el acceso por API a los nuevos controles de la 1.1 (extensión de escena, fotogramas clave, modo borrador de 360p, mejora de escala a 4K, entrada de vídeo de referencia) — este SDK se dirige a los endpoints de Gemini Omni Flash disponibles hoy en MuAPI y se actualizará cuando los endpoints de la 1.1 estén disponibles.
Compatibilidad de endpoints
El cliente utiliza las rutas gemini-omni-text-to-video, gemini-omni-image-to-video, gemini-omni-video-edit, gemini-omni-audio y gemini-omni-character bajo GEMINI_OMNI_API_BASE_URL. Si tu proveedor nombra sus endpoints de forma diferente, pasa la URL base compatible de ese proveedor o adapta el pequeño módulo del cliente antes de usarlo.
Licencia
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Plan, compare, price, generate, and recover AI video from compatible MCP clients.
AI image, video, voice and music generation over MCP, routed to Veo 3.1, Seedance 2.0 and more.
Create and manage AI image and video generations through Quriov's fixed public MCP tools.
MCP server for Google Veo AI video generation
Related MCP Servers
- AlicenseBqualityDmaintenanceMCP server that exposes Google's Veo2 video generation capabilities, allowing clients to generate videos from text prompts or images.732MIT

PixVerse MCPofficial
AlicenseNot gradedqualityFmaintenanceEnables video generation from text, images, and more through MCP-compatible apps like Claude and Cursor.52MIT- FlicenseNot gradedqualityDmaintenanceProvides a audio/video creation toolbox via MCP protocol, enabling natural language-based video editing tasks such as image-to-video, video merging, subtitle extraction, and more.3
- AlicenseNot gradedqualityBmaintenanceEnables AI agents to generate professional storyboards and videos from scripts or creative descriptions via MCP-compatible clients.47MIT
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Anil-matcha/Gemini-Omni-1.1-Flash-API'
If you have feedback or need assistance with the MCP directory API, please join our Discord server