generate_image
Generate or edit images from text prompts or reference images. Runs on multiple AI models, saves results locally, and returns file paths instead of base64 data.
Instructions
生成/编辑图片(OpenAI 兼容 /images/generations,模型名透传:gpt-image-2、gemini-3-pro-image、grok-imagine-image-quality、即梦、doubao-seedream 等)。默认保存到本地并只返回文件路径(零 base64)。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| n | No | 可选,生成数量(部分供应商支持)。 | |
| size | No | 可选,例如 1024x1024、1536x1024。 | |
| image | No | 可选,参考图(单张):公网 URL、Data URL、Base64、本地图片路径,或 @chatbox-latest(自动读取 Chatbox 最近拖入的图片)。提供后为图生图(部分模型支持)。 | |
| model | No | 可选,默认取 AI_MEDIA_IMAGE_MODEL。模型名透传。 | |
| images | No | 可选,多张参考图(图生图/多模态):每项为公网 URL、Data URL、Base64、本地图片路径或 @chatbox-latest(自动取最新拖入图)。例:["D:\a.png", "https://..."]。 | |
| prompt | Yes | 图片内容描述,越具体效果越好。 | |
| quality | No | 可选,standard/hd/high/medium/low。 | |
| output_dir | No | 可选,保存目录(默认 AI_MEDIA_IMAGE_OUTPUT_DIR)。 | |
| resolution | No | 可选,如 1k、2k(部分 xAI/grok 网关支持)。 | |
| auto_prompt | No | 自动提示词增强(默认开启)。当你只上传了参考图、提示词不足 15 字时,自动套用内置'无缝融合'增强模板(光影/透视/色调一致性,解决贴图感)。false=关闭。 | |
| return_mode | No | path=仅返回路径(默认);inline=返回图片数据;both=两者。注意 inline 会把 base64 带入对话上下文。 | |
| aspect_ratio | No | 可选,如 1:1、16:9、9:16(仅当未指定 size 时发送)。 |