Gemini Omni MCP Server
Gemini Omni 1.1 Flash API — Python-обёртка
Специализированный Python SDK и MCP-сервер для Google Gemini Omni Flash on MuAPI. Он поддерживает генерацию видео из текста, генерацию видео из изображений, редактирование видео, переиспользуемые голосовые профили, переиспользуемые профили персонажей и асинхронный опрос заданий.
Google анонсировала обновление Gemini Omni 1.1 Flash 27 августа 2026 года — с расширением сцены (до 10 секунд анализируемого контекста, до 40 секунд суммарной длительности), управлением ключевыми кадрами первого/последнего кадра, черновым режимом разрешения 360p, масштабированием до 4K и вводом видео-референса до 3 секунд. Подробности см. на muapi.ai/gemini-omni-1.1-flash. Этот клиент оборачивает эндпоинты Gemini Omni Flash, которые уже доступны на MuAPI; перечисленные выше функции, специфичные для 1.1, внедряются поэтапно и пока не доступны в этом SDK — этот README и код будут обновлены по мере их добавления в MuAPI.
Связанные проекты
Gemini Omni on MuAPI — Страница модели: генерация видео из текста, генерация видео из изображений, редактирование видео, голосовые профили, профили персонажей.
Gemini Omni 1.1 Flash on MuAPI — Что нового в обновлении 1.1 и статус внедрения.
gemini-omni-comfyui — Пользовательские узлы ComfyUI для Gemini Omni через MuAPI.
Awesome-Gemini-Omni-API-Prompts — Курируемая подборка промптов Gemini Omni и руководство по API.
awesome-ai-video-models — Сравнение AI-видеомоделей по API, цене и скорости.
Wan-3.0-API — Python SDK для генерации видео Wan 3.0 через MuAPI.
Veo-4-API — Python SDK для генерации видео Google Veo AI.
Seedance-2-API — Python SDK для генерации видео ByteDance Seedance.
Generative-Media-Skills — Готовые к использованию ИИ-агентами навыки для автоматизированных медиа-процессов.
muapi-cli — Доступ к моделям MuAPI для изображений, видео и аудио из командной строки.
Related MCP server: PixVerse MCP
Установка
git clone https://github.com/Anil-matcha/Gemini-Omni-1.1-Flash-API.git
cd Gemini-Omni-1.1-Flash-API
pip install -r requirements.txt
cp .env.example .envУкажите MUAPI_API_KEY в .env. GEMINI_OMNI_API_BASE_URL задавайте только в том случае, если вы используете совместимого провайдера, отличного от базового URL MuAPI по умолчанию.
Быстрый старт
from gemini_omni_api import GeminiOmniAPI
api = GeminiOmniAPI()
job = api.text_to_video(
"A street musician plays a violin on a rainy Paris evening, raindrops tap "
"the cobblestones, a slow melancholic melody, distant café chatter.",
duration=8,
resolution="1080p",
aspect_ratio="16:9",
)
result = api.wait_for_completion(job["request_id"])
print(result)Изображение в видео
job = api.image_to_video(
prompt="The subject slowly turns to face the camera as golden-hour light sweeps across the scene.",
image_urls=["https://example.com/reference.jpg"],
aspect_ratio="9:16",
duration=8,
)Редактирование видео
job = api.video_edit(
prompt="Restyle the entire clip as a hand-drawn Studio Ghibli animation, keep the original camera motion.",
video_url="https://example.com/source.mp4",
trim_start=0,
trim_end=10,
resolution="1080p",
)Голосовые профили и профили персонажей
voice = api.create_audio_profile("Narrator", preset_voice="warm-male-1", style_description="calm, deliberate pacing")
character = api.create_character_profile("Host", image_url="https://example.com/host.jpg")
job = api.text_to_video(
"The host welcomes viewers to the show.",
audio_ids=[voice["audioId"]],
character_ids=[character["characterId"]],
)Поверхность API
Метод | Назначение |
| Генерирует видео с синхронизированным звуком по текстовому запросу. |
| Анимирует 1–7 референсных изображений по текстовому запросу. |
| Изменяет стиль, освещение, заменяет объекты или переписывает диалог на основе исходного клипа. |
| Создаёт переиспользуемый голосовой профиль из предустановленного голоса; возвращает |
| Создаёт переиспользуемый профиль персонажа по референсному изображению; возвращает |
| Загружает локальный референсный файл. |
| Получает результат асинхронного задания. |
text_to_video(), image_to_video() и video_edit() принимают duration (4/6/8/10 секунд), resolution (720p, 1080p, 4k), aspect_ratio (16:9, 9:16), до 3 audio_ids, до 3 character_ids и seed.
MCP-сервер
Предоставьте инструменты Gemini Omni MCP-совместимым клиентам:
python mcp_server.pyСервер предоставляет инструменты text_to_video, image_to_video, video_edit, create_audio_profile, create_character_profile и get_task_status.
Статус: внедрение обновления 1.1
Google анонсировала Gemini Omni 1.1 Flash 27 августа 2026 года. Сейчас оно постепенно внедряется через Google AI Studio, Gemini Enterprise Agent Platform, Google Flow и приложение Gemini. MuAPI поэтапно открывает доступ к API для новых возможностей 1.1 (расширение сцены, ключевые кадры, черновой режим 360p, масштабирование до 4K, ввод видео-референса) — этот SDK нацелен на эндпоинты Gemini Omni Flash, доступные на MuAPI сегодня, и будет обновлён, когда эндпоинты 1.1 станут доступны.
Совместимость эндпоинтов
Клиент использует пути gemini-omni-text-to-video, gemini-omni-image-to-video, gemini-omni-video-edit, gemini-omni-audio и gemini-omni-character относительно GEMINI_OMNI_API_BASE_URL. Если ваш провайдер называет свои эндпоинты иначе, передайте совместимый базовый URL этого провайдера или адаптируйте небольшой клиентский модуль перед использованием.
Лицензия
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Connectors
Plan, compare, price, generate, and recover AI video from compatible MCP clients.
AI image, video, voice and music generation over MCP, routed to Veo 3.1, Seedance 2.0 and more.
Create and manage AI image and video generations through Quriov's fixed public MCP tools.
MCP server for Google Veo AI video generation
Related MCP Servers
- AlicenseBqualityDmaintenanceMCP server that exposes Google's Veo2 video generation capabilities, allowing clients to generate videos from text prompts or images.732MIT

PixVerse MCPofficial
AlicenseNot gradedqualityFmaintenanceEnables video generation from text, images, and more through MCP-compatible apps like Claude and Cursor.52MIT- FlicenseNot gradedqualityDmaintenanceProvides a audio/video creation toolbox via MCP protocol, enabling natural language-based video editing tasks such as image-to-video, video merging, subtitle extraction, and more.3
- AlicenseNot gradedqualityBmaintenanceEnables AI agents to generate professional storyboards and videos from scripts or creative descriptions via MCP-compatible clients.47MIT
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/Anil-matcha/Gemini-Omni-1.1-Flash-API'
If you have feedback or need assistance with the MCP directory API, please join our Discord server