Skip to main content
Glama

Gemini Omni 1.1 Flash API — Envoltorio de Python

Con tecnología de MuAPI Licencia: MIT Python 3.9+

Un SDK de Python y un servidor MCP centrados en Google Gemini Omni Flash on MuAPI. Admite text-to-video, image-to-video, video-edit, perfiles de voz reutilizables, perfiles de personaje reutilizables y sondeo asíncrono de trabajos.

Google anunció la actualización Gemini Omni 1.1 Flash el 27 de agosto de 2026 — que añade extensión de escena (hasta 10 segundos de contexto analizado, hasta 40 segundos de duración acumulada), control de fotogramas clave del primer/último fotograma, un modo de resolución de borrador de 360p, mejora de escala a 4K y hasta 3 segundos de entrada de vídeo de referencia. Consulta muapi.ai/gemini-omni-1.1-flash para más detalles. Este cliente envuelve los endpoints de Gemini Omni Flash que están activos hoy en MuAPI; los controles específicos de la 1.1 mencionados arriba se están implementando gradualmente y aún no están expuestos por este SDK — este README y el código se actualizarán a medida que MuAPI los añada.

Proyectos relacionados

  • Gemini Omni on MuAPI — Página de inicio del modelo: text-to-video, image-to-video, video-edit, perfiles de voz, perfiles de personaje.

  • Gemini Omni 1.1 Flash on MuAPI — Novedades de la actualización 1.1 y estado de implementación.

  • gemini-omni-comfyui — Nodos personalizados de ComfyUI para Gemini Omni a través de MuAPI.

  • Awesome-Gemini-Omni-API-Prompts — Biblioteca seleccionada de prompts de Gemini Omni y guía de API.

  • awesome-ai-video-models — Compara modelos de vídeo con IA por API, precio y velocidad.

  • Wan-3.0-API — SDK de Python para generación de vídeo Wan 3.0 a través de MuAPI.

  • Veo-4-API — SDK de Python para generación de vídeo con Google Veo AI.

  • Seedance-2-API — SDK de Python para generación de vídeo con ByteDance Seedance.

  • Generative-Media-Skills — Habilidades listas para agentes para flujos de trabajo multimedia automatizados.

  • muapi-cli — Acceso desde línea de comandos a los modelos de imagen, vídeo y audio de MuAPI.

Related MCP server: PixVerse MCP

Instalación

git clone https://github.com/Anil-matcha/Gemini-Omni-1.1-Flash-API.git
cd Gemini-Omni-1.1-Flash-API
pip install -r requirements.txt
cp .env.example .env

Configura MUAPI_API_KEY en .env. Configura GEMINI_OMNI_API_BASE_URL solo si utilizas un proveedor compatible distinto de la URL base predeterminada de MuAPI.

Inicio rápido

from gemini_omni_api import GeminiOmniAPI

api = GeminiOmniAPI()
job = api.text_to_video(
    "A street musician plays a violin on a rainy Paris evening, raindrops tap "
    "the cobblestones, a slow melancholic melody, distant café chatter.",
    duration=8,
    resolution="1080p",
    aspect_ratio="16:9",
)

result = api.wait_for_completion(job["request_id"])
print(result)

De imagen a vídeo

job = api.image_to_video(
    prompt="The subject slowly turns to face the camera as golden-hour light sweeps across the scene.",
    image_urls=["https://example.com/reference.jpg"],
    aspect_ratio="9:16",
    duration=8,
)

Edición de vídeo

job = api.video_edit(
    prompt="Restyle the entire clip as a hand-drawn Studio Ghibli animation, keep the original camera motion.",
    video_url="https://example.com/source.mp4",
    trim_start=0,
    trim_end=10,
    resolution="1080p",
)

Perfiles de voz y de personaje

voice = api.create_audio_profile("Narrator", preset_voice="warm-male-1", style_description="calm, deliberate pacing")
character = api.create_character_profile("Host", image_url="https://example.com/host.jpg")

job = api.text_to_video(
    "The host welcomes viewers to the show.",
    audio_ids=[voice["audioId"]],
    character_ids=[character["characterId"]],
)

Superficie de la API

Método

Propósito

text_to_video()

Genera un vídeo con audio sincronizado a partir de un prompt de texto.

image_to_video()

Anima de 1 a 7 imágenes de referencia con un prompt de texto.

video_edit()

Reestiliza, reilumina, intercambia sujetos o reescribe el diálogo a partir de un clip de origen.

create_audio_profile()

Crea un perfil de voz reutilizable a partir de una voz predefinida; devuelve un audioId.

create_character_profile()

Crea un perfil de personaje reutilizable a partir de una imagen de referencia; devuelve un characterId.

upload_file()

Sube un archivo de referencia local.

get_result() / wait_for_completion()

Recupera la salida de un trabajo asíncrono.

text_to_video(), image_to_video() y video_edit() aceptan duration (4/6/8/10 segundos), resolution (720p, 1080p, 4k), aspect_ratio (16:9, 9:16), hasta 3 audio_ids, hasta 3 character_ids y seed.

Servidor MCP

Expone las herramientas de Gemini Omni a clientes compatibles con MCP:

python mcp_server.py

El servidor proporciona las herramientas text_to_video, image_to_video, video_edit, create_audio_profile, create_character_profile y get_task_status.

Estado: implementación gradual de la actualización 1.1

Google anunció Gemini Omni 1.1 Flash el 27 de agosto de 2026. Actualmente se está implementando a través de Google AI Studio, la plataforma Gemini Enterprise Agent, Google Flow y la aplicación Gemini. MuAPI está implementando el acceso por API a los nuevos controles de la 1.1 (extensión de escena, fotogramas clave, modo borrador de 360p, mejora de escala a 4K, entrada de vídeo de referencia) — este SDK se dirige a los endpoints de Gemini Omni Flash disponibles hoy en MuAPI y se actualizará cuando los endpoints de la 1.1 estén disponibles.

Compatibilidad de endpoints

El cliente utiliza las rutas gemini-omni-text-to-video, gemini-omni-image-to-video, gemini-omni-video-edit, gemini-omni-audio y gemini-omni-character bajo GEMINI_OMNI_API_BASE_URL. Si tu proveedor nombra sus endpoints de forma diferente, pasa la URL base compatible de ese proveedor o adapta el pequeño módulo del cliente antes de usarlo.

Licencia

MIT

A
license - permissive license
Not graded
quality - not tested
C
maintenance

Maintenance

0Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Connectors

Related MCP Servers

View all related MCP servers

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Anil-matcha/Gemini-Omni-1.1-Flash-API'

If you have feedback or need assistance with the MCP directory API, please join our Discord server