read_document_image
Read embedded text from image-based documents (scanned PDFs or PNGs) when no text layer exists, enabling further analysis.
Instructions
텍스트가 없는 문서를 이미지로 받아 직접 판독합니다.
png는 원본을, pdf는 해당 페이지에 임베드된 이미지를 돌려줍니다.
스캔 PDF는 페이지 전체가 하나의 이미지이므로 이 방법으로 판독됩니다.
벡터로만 그려진 페이지는 꺼낼 수 없고, 그때는 오류가 사람이 할 일을 알려 줍니다.
이미지는 긴 변 1568px로 줄여서 넘어옵니다. 판독 정확도에는 영향이 없습니다.
판독한 내용은 원문 인용이 아닙니다. 요약에 쓸 때는 "(이미지 판독)"을 표기하세요. 텍스트 앵커와 같은 근거로 취급하면 안 됩니다.
Args: path: png 또는 pdf 경로. page: pdf의 페이지 번호.
Returns: list: 이미지 한 장과, 출처·크기·다음 단계를 적은 안내 문자열. (바이너리를 돌려주는 유일한 도구이므로 구조화 응답 규약에서 벗어납니다.)
Examples: - 사용: read_document가 등급 C를 돌려준 뒤 - 사용하지 않음: 등급 A·B 파일 → read_document로 텍스트를 읽는 게 정확합니다
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| page | No | pdf일 때 읽을 페이지 번호(1부터). png는 무시됩니다 | |
| path | Yes | png 파일, 또는 텍스트가 없는 pdf 파일 |