Skip to main content
Glama

Server Configuration

Describes the environment variables required to run the server.

NameRequiredDescriptionDefault
JIMENG_OUTPUT_DIRNo生成文件保存目录,默认 ~/jimeng-output
JIMENG_ACCESS_KEY_IDYes火山引擎 Access Key ID
JIMENG_SECRET_ACCESS_KEYYes火山引擎 Secret Access Key

Capabilities

Features and capabilities supported by this server

CapabilityDetails
tools
{
  "listChanged": false
}
prompts
{
  "listChanged": false
}
resources
{
  "subscribe": false,
  "listChanged": false
}
experimental
{}

Tools

Functions exposed to the LLM to take actions

NameDescription
generate_imageA

文生图:根据文字描述生成图片。

  • model(模型版本):

    • jimeng_t2i_v40 图片生成 4.0(默认,推荐)

    • jimeng_seedream46_cvtob 图片生成 4.6(Seedream,支持最高 4K)

    • jimeng_t2i_v31 文生图 3.1

    • jimeng_t2i_v30 文生图 3.0

    • jimeng_high_aes_general_v21_L 通用高美感 v2.1

  • aspect_ratio: 1:1 / 16:9 / 9:16 / 4:3 / 3:4 / 3:2 / 2:3

  • quality: 2k(默认)/ normal

  • negative_prompt: 负面提示词(可选,部分模型不支持)

image_to_imageA

图生图(智能参考):参考输入图片,结合文字描述编辑或生成新图片。 使用即梦图生图 3.0 模型(jimeng_i2i_v30)。

  • image_url: 参考图片 URL(JPEG/PNG,最大 4.7MB,最大 4096×4096)

  • aspect_ratio: 1:1 / 16:9 / 9:16 / 4:3 / 3:4 / 3:2 / 2:3

  • quality: 2k(默认)/ normal

  • scale: 文本影响程度 0.0~1.0(默认 0.5,越大越贴近文字描述,越小越保留原图)

inpaint_imageA

局部重绘(Inpainting):在图片的指定区域(mask)内根据提示词重新生成内容。 使用即梦交互编辑模型(jimeng_image2image_dream_inpaint)。

  • image_url: 原图 URL(JPEG/PNG,最大 4.7MB)

  • mask_url: 遮罩图 URL(单通道灰度图,白色=重绘区域,黑色=保留区域)

  • prompt: 重绘内容描述;输入"删除"可消除选区内容

upscale_imageA

智能超清:将图片放大并增强细节至 4K 或 8K 分辨率。 使用即梦智能超清模型(jimeng_i2i_seed3_tilesr_cvtob)。

  • image_url: 输入图片 URL(JPEG/PNG,最大 4.7MB,最大 4096×4096)

  • resolution: "4k"(默认)或 "8k"

  • detail: 细节生成程度 0~100(默认 50,越大细节越多但可能偏离原图)

generate_videoA

文生视频:根据文字描述生成视频(约需 1~5 分钟)。

  • model(模型版本):

    • jimeng_t2v_v30 视频生成 3.0 720P(默认)

    • jimeng_t2v_v30_1080p 视频生成 3.0 1080P

    • jimeng_ti2v_v30_pro 视频生成 3.0 Pro 1080P(效果更好)

  • aspect_ratio: 16:9 / 4:3 / 1:1 / 3:4 / 9:16 / 21:9

  • duration_sec: 5(默认)或 10

image_to_videoA

图生视频:将静态图片转换为动态视频(约需 1~5 分钟)。

  • image_url: 首帧图片 URL(JPEG/PNG,最大 4.7MB)

  • prompt: 视频内容描述(必填)

  • mode(模式):

    • first 首帧驱动 720P(默认)

    • first_1080p 首帧驱动 1080P

    • first_tail 首尾帧驱动 720P(需提供 tail_image_url)

    • first_tail_1080p 首尾帧驱动 1080P(需提供 tail_image_url)

    • recamera 重新运镜 720P(需提供 template_id,通过 prompt 描述运镜效果)

    • pro 视频生成 3.0 Pro 1080P(首帧,效果更好)

  • duration_sec: 5(默认)或 10

  • tail_image_url: 尾帧图片 URL(仅 first_tail / first_tail_1080p 模式需要)

recamera 模式可用运镜模板(在 prompt 中指定 template_id): hitchcock_dolly_in / hitchcock_dolly_out / robo_arm / dynamic_orbit / central_orbit / crane_push / quick_pull_back / counterclockwise_swivel / clockwise_swivel / handheld / rapid_push_pull

imitate_motionA

动作模仿 2.0:提取参考视频中的动作/表情/口型,迁移到目标人物图片上。 使用模型:jimeng_dreamactor_m20_gen_video

  • image_url: 目标人物图片 URL(JPEG/PNG,480×480 以上,1920×1080 以内)

  • video_url: 动作参考视频 URL(MP4/MOV/WEBM,最长 30 秒)

输出视频约需 3~5 分钟(10 秒视频约需 180 秒)。

generate_digital_humanA

数字人生成(OmniHuman 1.5):驱动人物图片口型和动作,配合音频生成说话视频。 使用模型:jimeng_realman_avatar_picture_omni_v15

  • portrait_url: 人物肖像图片 URL(含人物/动漫/宠物)

  • audio_url: 驱动音频 URL(WAV/MP3,必须小于 60 秒)

  • resolution: 输出分辨率,720 或 1080(默认 1080)

  • prompt: 可选提示词,支持中/英/日/韩语,最长 300 字符

注意:此接口使用 CVSubmitTask/CVGetResult(与普通接口不同)。

translate_videoA

视频翻译 2.0:将视频中的语音翻译并口型同步为目标语言。 使用模型:video_translate_v2_cvtob

  • video_url: 原始视频 URL(需公网可访问)

  • target_language: 目标语言缩写

  • src_language: 源语言缩写(默认 "zh" 中文)

支持的语言代码: zh(中文)en(英语)ja(日语)ko(韩语)fr(法语)de(德语) es(西班牙语)pt(葡萄牙语)ru(俄语)ar(阿拉伯语)it(意大利语) hi(印地语)id(印尼语)nl(荷兰语)tr(土耳其语)pl(波兰语)等

Prompts

Interactive templates invoked by user choice

NameDescription

No prompts

Resources

Contextual data attached and managed by the client

NameDescription

No resources

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/andyleimc-source/jimeng-ai-mcp'

If you have feedback or need assistance with the MCP directory API, please join our Discord server