img2text
Convert an image from a local path, URL, data URL, or base64 into a plain-text description. This lets text-only language models understand visual content when they cannot view the image directly.
Instructions
读取图片并把内容转换为文字描述。接受本地文件路径、http(s) URL、data URL 或 base64。由外部视觉模型(VISION_PROVIDERS 配置的一组 OpenAI 兼容模型,自动 fallback)完成识别,返回纯文本,供本身不支持图片输入的模型理解图片。使用时机:① 你能直接查看图片时(原生多模态输入),无需调用本工具;② 用户提供图片路径/URL/图片附件引用(形如 "[图片附件:名称] 图片文件:<绝对路径>")且你无法直接看到图片内容时,立即调用本工具读取并转述内容,不要回复"无法查看图片";③ 用户要求分析/读取某张图片时。prompt 参数:用户有具体问题时传用户的问题;没有问题时不要传(server 使用默认提示词)。转述时保持简洁:先一句话概括图片是什么,再列关键信息(主要文字、重点元素),不要输出大段分析。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| image | Yes | 图片来源:本地绝对路径 / http(s) URL / data URL / base64 字符串;图片附件引用中的 "图片文件:" 后即为绝对路径 | |
| prompt | No | 可选分析指令。用户有具体问题时传用户的问题;没有问题时不要传此参数(server 使用默认提示词) | |
| max_tokens | No | 可选,覆盖视觉模型最大输出 token 数 |