read_image_text
Extract text from PNG images using OCR. Read wording from screenshots, scanned notes, or labels inside diagrams.
Instructions
PNG 이미지 하나를 OCR로 읽어 텍스트를 추출합니다(Tesseract-OCR 필요).
스크린샷, 스캔한 메모, 다이어그램에 박힌 라벨처럼 이미지 안의 문자를 읽어야 할 때 사용하세요. 순수 그림/사진처럼 텍스트가 없는 이미지는 빈 결과가 나올 수 있습니다(비전 해석이 아니라 OCR이므로 그림 자체의 의미는 파악하지 못합니다).
Returns:
ReadImageTextResponse: text에 인식된 문자열이 담깁니다. 결과가 비어
있으면 next_actions에서 그 이유를 안내합니다.
Examples: - 사용: "이 스크린샷에 뭐라고 적혀 있어?" - 사용하지 않음: pdf/docx/pptx/svg 문서 → read_document
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| file_path | Yes | OCR로 읽을 PNG 이미지의 절대 경로 | |
| max_chars | No | 반환할 최대 문자 수(컨텍스트 보호용 절단) |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| path | Yes | ||
| text | Yes | ||
| status | Yes | OK 또는 PARTIAL 등 처리 결과 상태 | |
| metadata | Yes | ||
| truncated | Yes | ||
| next_actions | No |