see_image
Reads images from local files, URLs, clipboard, or recent screenshots and returns text descriptions via a vision model. Enables text-only AI models to understand image content.
Instructions
读取图片(本地文件 / URL / 剪贴板 / 最近截图)并通过视觉模型返回文字描述。用于主模型无多模态输入能力时的识图。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| prompt | No | 对图片的提问或指令,省略则默认详细描述图片内容与其中文字 | |
| source | Yes | 图片来源:本地路径(支持 ~ 展开)、http(s) URL、"latest"(截图目录最新图)、"clipboard"(剪贴板,仅 mac/win) |