mimo_describe_image
Analyzes images from local paths, public URLs, or pasted content. Returns text descriptions for text-only AI models.
Instructions
仅当当前主模型为纯文本模型(如 DeepSeek-R1、DeepSeek-V3、GLM 纯文本版等)无法识别图片时使用的降级视觉识别工具。将本地图片路径、公网 URL 或对话框粘贴的图片发送给小米 MiMo-V2.5 模型解析并返回文本描述。若当前主模型本身具备原生多模态视觉能力(如 GPT-4o、Claude 3.5/3.7 Sonnet、Claude Opus 5、Gemini、Qwen2.5-VL、GLM-4V 等),绝对禁止调用本工具,必须由主模型直接看图。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| images | No | ||
| question | No | 请描述图片中的元素与数据信息内容 | |
| thinking | No | ||
| extract_pasted | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||