Gemini Omni MCP Server
Gemini Omni 1.1 Flash API — Python-Wrapper
Ein fokussiertes Python-SDK und ein MCP-Server für Google Gemini Omni Flash auf MuAPI. Es unterstützt Text-zu-Video, Bild-zu-Video, Video-Bearbeitung, wiederverwendbare Sprachprofile, wiederverwendbare Charakterprofile und asynchrones Job-Polling.
Google hat das Gemini Omni 1.1 Flash-Update am 27. August 2026 angekündigt — mit Szenenerweiterung (bis zu 10 Sekunden analysierter Kontext, bis zu 40 Sekunden Gesamtlänge), Keyframe-Steuerung für das erste/letzte Frame, einem 360p-Entwurfsauflösungsmodus, 4K-Upscaling und bis zu 3 Sekunden Video-Referenzeingabe. Details finden Sie unter muapi.ai/gemini-omni-1.1-flash. Dieser Client kapselt die Gemini Omni Flash-Endpunkte, die heute auf MuAPI verfügbar sind; die oben genannten 1.1-spezifischen Steuerungen werden schrittweise ausgerollt und sind von diesem SDK noch nicht bereitgestellt — dieses README und der Code werden aktualisiert, sobald MuAPI sie hinzufügt.
Verwandte Projekte
Gemini Omni auf MuAPI — Modell-Landingpage: Text-zu-Video, Bild-zu-Video, Video-Bearbeitung, Sprachprofile, Charakterprofile.
Gemini Omni 1.1 Flash auf MuAPI — Neuerungen im1.1-Update und Rollout-Status.
gemini-omni-comfyui — ComfyUI-Custom-Nodes für Gemini Omni über MuAPI.
Awesome-Gemini-Omni-API-Prompts — Kuratierte Prompt-Bibliothek für Gemini Omni und API-Leitfaden.
awesome-ai-video-models — Vergleiche KI-Videomodelle nach API, Preis und Geschwindigkeit.
Wan-3.0-API — Python-SDK für die Wan-3.0-Videogenerierung über MuAPI.
Veo-4-API — Python-SDK für die Google-Veo-AI-Videogenerierung.
Seedance-2-API — Python-SDK für die Videogenerierung mit ByteDance Seedance.
Generative-Media-Skills — Agentenbereite Skills für automatisierte Medien-Workflows.
muapi-cli — Befehlszeilenzugriff auf MuAPI-Bild-, Video- und Audiomodelle.
Related MCP server: PixVerse MCP
Installation
git clone https://github.com/Anil-matcha/Gemini-Omni-1.1-Flash-API.git
cd Gemini-Omni-1.1-Flash-API
pip install -r requirements.txt
cp .env.example .envLegen Sie MUAPI_API_KEY in .env fest. Setzen Sie GEMINI_OMNI_API_BASE_URL nur, wenn Sie einen kompatiblen Anbieter verwenden, der nicht die Standard-MuAPI-Basis-URL nutzt.
Schnellstart
from gemini_omni_api import GeminiOmniAPI
api = GeminiOmniAPI()
job = api.text_to_video(
"A street musician plays a violin on a rainy Paris evening, raindrops tap "
"the cobblestones, a slow melancholic melody, distant café chatter.",
duration=8,
resolution="1080p",
aspect_ratio="16:9",
)
result = api.wait_for_completion(job["request_id"])
print(result)Bild-zu-Video
job = api.image_to_video(
prompt="The subject slowly turns to face the camera as golden-hour light sweeps across the scene.",
image_urls=["https://example.com/reference.jpg"],
aspect_ratio="9:16",
duration=8,
)Video-Bearbeitung
job = api.video_edit(
prompt="Restyle the entire clip as a hand-drawn Studio Ghibli animation, keep the original camera motion.",
video_url="https://example.com/source.mp4",
trim_start=0,
trim_end=10,
resolution="1080p",
)Sprach- und Charakterprofile
voice = api.create_audio_profile("Narrator", preset_voice="warm-male-1", style_description="calm, deliberate pacing")
character = api.create_character_profile("Host", image_url="https://example.com/host.jpg")
job = api.text_to_video(
"The host welcomes viewers to the show.",
audio_ids=[voice["audioId"]],
character_ids=[character["characterId"]],
)API-Oberfläche
Methode | Zweck |
| Ein Video mit synchronisiertem Audio aus einer Textaufforderung erzeugen. |
| 1–7 Referenzbilder mit einer Textaufforderung animieren. |
| Ein Quellclip neu stylen, neu beleuchten, Subjekte austauschen oder Dialoge umschreiben. |
| Ein wiederverwendbares Sprachprofil aus einer voreingestellten Stimme erstellen; gibt eine |
| Ein wiederverwendbares Charakterprofil aus einem Referenzbild erstellen; gibt eine |
| Eine lokale Referenzdatei hochladen. |
| Die Ausgabe eines asynchronen Auftrags abrufen. |
text_to_video(), image_to_video() und video_edit() akzeptieren duration (4/6/8/10 Sekunden), resolution (720p, 1080p, 4k), aspect_ratio (16:9, 9:16), bis zu 3 audio_ids, bis zu 3 character_ids und seed.
MCP-Server
Stellen Sie die Tools von Gemini Omni für MCP-fähige Clients bereit:
python mcp_server.pyDer Server stellt die Tools text_to_video, image_to_video, video_edit, create_audio_profile, create_character_profile und get_task_status bereit.
Status: 1.1-Update wird ausgerollt
Google hat Gemini Omni 1.1 Flash am 27. August 2026 angekündigt. Das Update wird derzeit über Google AI Studio, die Gemini Enterprise Agent Platform, Google Flow und die Gemini-App ausgerollt. MuAPI rollt den API-Zugriff für die neuen 1.1-Steuerungen aus (Szenenerweiterung, Keyframes, 360p-Entwurfsmodus, 4K-Upscaling, Video-Referenzeingabe) — dieses SDK zielt auf die heute auf MuAPI verfügbaren Gemini Omni Flash-Endpunkte und wird aktualisiert, sobald die 1.1-Endpunkte live gehen.
Endpunkt-Kompatibilität
Der Client verwendet die Pfade gemini-omni-text-to-video, gemini-omni-image-to-video, gemini-omni-video-edit, gemini-omni-audio und gemini-omni-character unterhalb von GEMINI_OMNI_API_BASE_URL. Wenn Ihr Anbieter seine Endpunkte anders benennt, übergeben Sie die kompatible Basis-URL dieses Anbieters oder passen Sie das kleine Client-Modul vor der Verwendung an.
Lizenz
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Plan, compare, price, generate, and recover AI video from compatible MCP clients.
AI image, video, voice and music generation over MCP, routed to Veo 3.1, Seedance 2.0 and more.
Create and manage AI image and video generations through Quriov's fixed public MCP tools.
MCP server for Google Veo AI video generation
Related MCP Servers
- AlicenseBqualityDmaintenanceMCP server that exposes Google's Veo2 video generation capabilities, allowing clients to generate videos from text prompts or images.732MIT

PixVerse MCPofficial
AlicenseNot gradedqualityFmaintenanceEnables video generation from text, images, and more through MCP-compatible apps like Claude and Cursor.52MIT- FlicenseNot gradedqualityDmaintenanceProvides a audio/video creation toolbox via MCP protocol, enabling natural language-based video editing tasks such as image-to-video, video merging, subtitle extraction, and more.3
- AlicenseNot gradedqualityBmaintenanceEnables AI agents to generate professional storyboards and videos from scripts or creative descriptions via MCP-compatible clients.47MIT
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Anil-matcha/Gemini-Omni-1.1-Flash-API'
If you have feedback or need assistance with the MCP directory API, please join our Discord server