analyze_image
Describe images, screenshots, charts, and photos for text-only LLMs. Switch to OCR mode to extract exact text or table content.
Instructions
当用户提供图片、截图、图表、照片,或要求查看图像内容时,调用本工具获取图片的视觉内容描述。
注意:本工具面向「自身无法直接查看图片」的主模型。若你自身具备原生视觉、能直接查看图片内容,应优先使用自己的原生视觉能力,无需调用本工具;仅在自身无法直接看图时才使用本工具。
默认使用 mode=full 进行完整视觉理解。仅当用户明确要求精确提取图片文字/表格内容时,使用 mode=ocr。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| mode | No | "full"(默认,全面理解)或 "ocr"(仅提取文字)。 | full |
| path_or_url | Yes | 本地图片路径或 http(s) URL。 |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |