analyze_image
Analyze local images by file path or base64 data, using vision models to extract text, objects, or scene details. Accepts custom prompts and model selection.
Instructions
分析一张本地图片(通过路径或 base64 数据传入),返回视觉模型的识别结果
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| model | No | 覆盖默认的视觉模型,如 gpt-4o、qwen-vl-max | |
| prompt | No | 视觉分析指令,例如:请识别图片中的文字 | |
| provider | No | 使用的 API 服务商名称(config.json 中配置) | |
| mime_type | No | 图片 MIME 类型,如 image/png(当 image_data 为纯 base64 时需要) | |
| image_data | No | 图片 base64 数据,或带 data:image/png;base64, 前缀的 data URL | |
| image_path | No | 本地图片文件路径,如 C:/Users/me/photo.png 或 ./screenshot.png | |
| max_tokens | No | 生成的最大 token 数(可选,不传则由服务商决定) | |
| temperature | No | 采样温度,默认 0.7 |