Skip to main content
Glama

ai-media-mcp

単一ファイル・依存性ゼロのMCPサーバーであり、GPT-Image / Gemini / Grok / Jimeng 向けの 画像&動画生成 を行えます。base64 は使わず、すべての生成物をローカルディスクに保存し、ファイルパスだけを返します。

Node.js 18+ が必要です。npm install 不要、ビルドステップ不要。.m を実行するだけです。


✨ 機能

  • 画像生生成GPT_image: OpenAI 互換の単一パスでモデル名を pass-through(gpt-image-2 / gemini-3-pro-image / grok-imagine-image-quality / doubao-seedream / Jimeng画像モデル など)。

  • 🎬 動画生成generate_video(送信のみ) / get_video_status(ポーリング) / generate_and_wait(にするA multi-listed model? Wait, they write "grok-imagine-video" etc.

Let's pause: The "🦆" inserted above is not. Let's not insert.

Proceed.

Let's produce the final content with exact source code variable names and no extra ":"; must be careful.

Let's do the output in a calm way without needing to reference. I'll write now:


ai-media-mcp

単一ファイル・依存ゼロのMCPサーバーで、画像&動画生成に対応しています(GPT-image / Gemini / Grok / Jimeng)。base64は使わず、すべてディスクに保存し、ファイルパスのみを返します。

Node.js 18+ が必要です。npm install やビルドステップは不要で、.mjs を実行するだけです。


Actually keep "divider" ***.

Now# ai-media-mcp

画像&動画生成のため単一ファイル・依存ゼロのMCPサーバーです。GPT-Image / Gemini / Grok / Jimeng に対応し、base64 は一切使わず、すべてディスクに保存してファイルパスだけを返します。

Node.js 18+ が必要です。npm install もビルドステップも不要で、.mjs を実行するだけです。


Related MCP server: imagen-mcp

✨ 機能

  • 🖼 画像生成generate_image: 単一の OpenAI 互換パス、モデル名パススルー(gpt-image-2 / gemini-3-pro-image / grok-imagine-image-quality / doubao-seedream / Jimeng 画像モデルなど)

  • 🎬 動画生成generate_video(送信のみ) / get_video_status(ポーリング) / generate_video_and_wait(送信 → ポーリング → ダウンロード)。Grok 動画と Jimeng 動画を自動ルーティングします。

  • 🔑 複数キー ルーティング — モデルが異なると、各々の APIキー と base URL を自動的に使用します(対象レー・アグリゲーター ゲートウエーで一般的)。

  • 🚫 base64 不要 — 画像・動画はローカルディスクに保存され、レスポンスは Saved to: ... のみを含みます(通常の MCP ラッパーが約 3 MB なに対 し、約 350 バイトー)。

  • 📚 ケパビリティ検索(Capability lookup)list_model_capabilities: モデル別に使用方法を照会し、逆引照会(size: "720p", aspect_gro: "21:9")。コストゼロ。* ** マルチ参照画像(画像 from 画像)**images 列(最大5名): Gemini ネイテー の多画像 APIは複数 inlineData、GPT/Grok は editsgerations のフォールバックがあっ。要求されたモデルは維持されます。GPT, Gemini, Grok は各々2参照経路テストに合格。

  • 🎬 TheToMovie参照動画(image・to・video) — 単一 image(Grok image_url, Jimeng first_frame_url)または複数の images(Jimeng reference_image_urls 最大9、Grok image_url 配列フォールバック)。

  • ✍ 自動プロンプト補強auto_prompt: true(デフォルト):プロンプトが15文字未満かつ参照画像がある場合、内部の「シームレス融合」テンプレートを適用(照明 / パースペクティブ / カラーグレーディング / カットアウト防止の指示は実際の生成で確認済)。

  • 🔑 @chatbox-latestimage: "@chatbox-latst" を渡すと、Chatbox ウィンドウにドラッグされた最新の画像(chatbox-bboxe...)を自動的に読み込みます。images 内のエイアスを更复すると、UI の附も重複を保持します。

  • 🔑 Verifyable references — 生成された画像ごとに、上流に送られた厳密なバイトから**証された reference_images メタデータを返します: 安全なソースのラベル、MIME、バ数、寸法、SHA-256。

  • 📥 Sbox delivery — 呼び出し元は、書き込み可能な box ケースを output_dir とし、return_mode: "path" を維持し、複数の (前) file をローカルに落とすことなく、返されたファイルをダウンロードカードに利用できます。


📦 インストール

# Just clone/copy the mjs and run it directly
node ai-media-mcp.mjs

npm 依存がありません。MCP クライアント(例: Chatbox / Claude Desktop)に stdio サーバーとして追加します:

{
  "command": "node",
  "args": ["/path/to/ai-media-mcp.mjs"],
  "env": { "...": "see .env.example" }
}

構成

再分はすべて オプションAIMEDIA_API_KEY / AIMEDIA_BASE_URL の統合グループは、各グーループの変数が必須ときのみ使われる。グループキーが明らかに存在するのに空(例: AI_MEDIA_JIMENG_API_KEY=)のときは、そのグループを無効にして他のプローバーのキーを再利用しません。

| 変数 | グループ | 説明 | | --- | | AI_MEDIA_GP_API_KEY など | GPT | gpt-Image-2 / doubao-* / Jimeng 画像 | | AIMEDIA_GEM_I_API_KEY | Gemini | ネイティブGeminAPI (/em/etc...:generateContent) | | AI_MEDIA_GROK_API_KEY など | Grook | grok-imagine-image-quality / grok-imagine-video | | AI_MEDIA_JIMENG_API_KEY 等 | Jmineg | as-sd2.0-fast / video-ds-2.0 | | AI_MEDIA_API_KEY / AI_MEDIA_BASE_URL | 統合 | 全グループのフォールバック | | AI_MEDIA_IAMGE_MODEL | — | デフォルト画像モデル (gpt-image-2) | | AI_MEDIA_VIDEO_MODEL | — | デフォルト動画モデル (grok-imagine-video) | | AI_MEDIA_IMAGE_OUTPUT_DIR / AI_MEDIA_VIDEO_OUTPUT_DIR | — | 出力ディレクトリ | | AI_MEDIA_RETURN_MODE | — | path(デフォルト、base64 不要) / inline / both | | AI_MEDIA_AUO_PROMPT | — | autuo(デフォルト) / never | | AI_MEDIA_TIMEOUT_MS / AI_MEDIA_POLL_INTERVAL_MS | — | タームアウト |


ルールティング

モデル名のプフィックス:

| モデルプレフィックス | グループ | API | | --- | | gemini-* / imagen-* | Gemini | ネイティブ /em/etc/models/{model}:generateContent | | grok-* | Grok | OpenAI互換 | | video-d* / as-d* | Jimeng | タスクベースの posted/videos | | 他 (gpt-*, doubao-*, Jimeng 画像) | GPT | OpenAI 互換 |


ツール

ツール

目ート

generate_image

画像生成 (n, size/aspect_ratio/quality, image/images 参照, auto_prompt)

generate_video

動画タスクのみ送信 (Grok/auto, image/images サポート)

get_video_status

タスク状態の照会

generate_video_and_wait

送信→ポーリング→ output_dir(または設定されたディフォルト)にダウンロードし、ファイルパスを返す

list_model_capabilities

モデルの能力スティ (解像度/レシオ/長) が、size/体型での逆引きも可

probe_capabilities

最小限実テストで実測のサイズ/ラティオを調べ、結果をかシュ


📄 Llicense

MIT

Install Server
A
license - permissive license
A
quality
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
1Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

View all related MCP servers

Related MCP Connectors

  • Generate images, video, and audio with Glif's media-generation agent

  • OCR, transcription, file extraction, and image generation for AI agents via MCP.

  • Transform video, audio and images, and generate media from prompts. FFmpeg, captions, models.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/wojiaopanhaoran/ai-media-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server