Skip to main content
Glama

Gemini Omni 1.1 Flash API — Python-Wrapper

Unterstützt von MuAPI Lizenz: MIT Python 3.9+

Ein fokussiertes Python-SDK und ein MCP-Server für Google Gemini Omni Flash auf MuAPI. Es unterstützt Text-zu-Video, Bild-zu-Video, Video-Bearbeitung, wiederverwendbare Sprachprofile, wiederverwendbare Charakterprofile und asynchrones Job-Polling.

Google hat das Gemini Omni 1.1 Flash-Update am 27. August 2026 angekündigt — mit Szenenerweiterung (bis zu 10 Sekunden analysierter Kontext, bis zu 40 Sekunden Gesamtlänge), Keyframe-Steuerung für das erste/letzte Frame, einem 360p-Entwurfsauflösungsmodus, 4K-Upscaling und bis zu 3 Sekunden Video-Referenzeingabe. Details finden Sie unter muapi.ai/gemini-omni-1.1-flash. Dieser Client kapselt die Gemini Omni Flash-Endpunkte, die heute auf MuAPI verfügbar sind; die oben genannten 1.1-spezifischen Steuerungen werden schrittweise ausgerollt und sind von diesem SDK noch nicht bereitgestellt — dieses README und der Code werden aktualisiert, sobald MuAPI sie hinzufügt.

Verwandte Projekte

Related MCP server: PixVerse MCP

Installation

git clone https://github.com/Anil-matcha/Gemini-Omni-1.1-Flash-API.git
cd Gemini-Omni-1.1-Flash-API
pip install -r requirements.txt
cp .env.example .env

Legen Sie MUAPI_API_KEY in .env fest. Setzen Sie GEMINI_OMNI_API_BASE_URL nur, wenn Sie einen kompatiblen Anbieter verwenden, der nicht die Standard-MuAPI-Basis-URL nutzt.

Schnellstart

from gemini_omni_api import GeminiOmniAPI

api = GeminiOmniAPI()
job = api.text_to_video(
    "A street musician plays a violin on a rainy Paris evening, raindrops tap "
    "the cobblestones, a slow melancholic melody, distant café chatter.",
    duration=8,
    resolution="1080p",
    aspect_ratio="16:9",
)

result = api.wait_for_completion(job["request_id"])
print(result)

Bild-zu-Video

job = api.image_to_video(
    prompt="The subject slowly turns to face the camera as golden-hour light sweeps across the scene.",
    image_urls=["https://example.com/reference.jpg"],
    aspect_ratio="9:16",
    duration=8,
)

Video-Bearbeitung

job = api.video_edit(
    prompt="Restyle the entire clip as a hand-drawn Studio Ghibli animation, keep the original camera motion.",
    video_url="https://example.com/source.mp4",
    trim_start=0,
    trim_end=10,
    resolution="1080p",
)

Sprach- und Charakterprofile

voice = api.create_audio_profile("Narrator", preset_voice="warm-male-1", style_description="calm, deliberate pacing")
character = api.create_character_profile("Host", image_url="https://example.com/host.jpg")

job = api.text_to_video(
    "The host welcomes viewers to the show.",
    audio_ids=[voice["audioId"]],
    character_ids=[character["characterId"]],
)

API-Oberfläche

Methode

Zweck

text_to_video()

Ein Video mit synchronisiertem Audio aus einer Textaufforderung erzeugen.

image_to_video()

1–7 Referenzbilder mit einer Textaufforderung animieren.

video_edit()

Ein Quellclip neu stylen, neu beleuchten, Subjekte austauschen oder Dialoge umschreiben.

create_audio_profile()

Ein wiederverwendbares Sprachprofil aus einer voreingestellten Stimme erstellen; gibt eine audioId zurück.

create_character_profile()

Ein wiederverwendbares Charakterprofil aus einem Referenzbild erstellen; gibt eine characterId zurück.

upload_file()

Eine lokale Referenzdatei hochladen.

get_result() / wait_for_completion()

Die Ausgabe eines asynchronen Auftrags abrufen.

text_to_video(), image_to_video() und video_edit() akzeptieren duration (4/6/8/10 Sekunden), resolution (720p, 1080p, 4k), aspect_ratio (16:9, 9:16), bis zu 3 audio_ids, bis zu 3 character_ids und seed.

MCP-Server

Stellen Sie die Tools von Gemini Omni für MCP-fähige Clients bereit:

python mcp_server.py

Der Server stellt die Tools text_to_video, image_to_video, video_edit, create_audio_profile, create_character_profile und get_task_status bereit.

Status: 1.1-Update wird ausgerollt

Google hat Gemini Omni 1.1 Flash am 27. August 2026 angekündigt. Das Update wird derzeit über Google AI Studio, die Gemini Enterprise Agent Platform, Google Flow und die Gemini-App ausgerollt. MuAPI rollt den API-Zugriff für die neuen 1.1-Steuerungen aus (Szenenerweiterung, Keyframes, 360p-Entwurfsmodus, 4K-Upscaling, Video-Referenzeingabe) — dieses SDK zielt auf die heute auf MuAPI verfügbaren Gemini Omni Flash-Endpunkte und wird aktualisiert, sobald die 1.1-Endpunkte live gehen.

Endpunkt-Kompatibilität

Der Client verwendet die Pfade gemini-omni-text-to-video, gemini-omni-image-to-video, gemini-omni-video-edit, gemini-omni-audio und gemini-omni-character unterhalb von GEMINI_OMNI_API_BASE_URL. Wenn Ihr Anbieter seine Endpunkte anders benennt, übergeben Sie die kompatible Basis-URL dieses Anbieters oder passen Sie das kleine Client-Modul vor der Verwendung an.

Lizenz

MIT

A
license - permissive license
Not graded
quality - not tested
C
maintenance

Maintenance

0Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Connectors

Related MCP Servers

View all related MCP servers

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/Anil-matcha/Gemini-Omni-1.1-Flash-API'

If you have feedback or need assistance with the MCP directory API, please join our Discord server