image_ocr
Extract text from images with OCR, preserving formatting and reading order. Handles screenshots, tables, forms, and scanned documents.
Instructions
专用OCR文字提取工具。从图片中高精度提取所有文字内容,保留格式和阅读顺序。 适合场景:文档截图、代码截图、表格、表单、扫描件。 如果是PDF文档,建议使用本地MinerU skill处理。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| image_source | Yes | 要提取文字的图片(路径/URL/Data URI) | |
| language_hint | No | 语言提示,帮助OCR引擎优化识别 | |
| output_format | No | 输出格式:纯文本、Markdown(保留表格结构)或JSON(结构化) |