analyze_image
Analyze images using multimodal AI to extract text, objects, scenes, and charts from local files, Base64, or URLs.
Instructions
使用多模态模型分析图片内容。支持本地文件路径、Base64 编码、或图片 URL。可用于识别图中文字、物体、场景、图表等。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| model | No | 可选:覆盖默认模型(如 qwen-vl-plus 做快速 OCR,qwen-vl-max 做复杂分析)。留空用 OPENAI_MODEL。 | |
| detail | No | 图片解析精度(仅 OpenAI 官方端点生效)。auto=自动, low=低精度(更快), high=高精度。默认 auto。 | auto |
| prompt | No | 对图片的分析指令,例如:'请描述这张图片的内容'、'提取图中的文字'、'这张图表说明了什么'。留空则默认描述。 | |
| image_url | No | 图片的公网 URL 地址。与 image_path、image_base64 三选一。 | |
| image_path | No | 本地图片文件的绝对路径(仅接受 PNG/JPEG/GIF/WebP/BMP)。与 image_base64、image_url 三选一。 | |
| image_base64 | No | 图片的 Base64 编码字符串(不含 data: 前缀)。与 image_path、image_url 三选一。 |