inspect_document
Check a document's structure and confirmed grade before reading it, saving context by avoiding full text loading. Use it to verify scan or text type and plan read_document calls.
Instructions
본문 없이 구조와 확정 등급만 돌려줍니다.
read_document 전에 부르세요. 300페이지 PDF에서 "이게 어떻게 생긴 문서인지"를
알려고 본문 전체를 컨텍스트에 붓는 일을 막는 도구입니다.
scan_folder의 expected_grade는 확장자 추정값이라 pdf·svg가 B?로
남습니다. 이 도구가 파일을 열어서 확정합니다. 스캔 PDF와 텍스트 PDF가
여기서 갈립니다.
파일을 여는 비용은 read_document와 같습니다. 절약되는 것은 시간이 아니라
컨텍스트입니다.
Args: path: 분석할 파일.
Returns: InspectResponse: 확정 등급과 근거, 제목 트리, 블록 수, 본문 글자 수, 전체를 읽는 데 필요한 호출 횟수 추정, 이미지 판독이 필요한 블록 앵커, 형식별 메타.
Examples: - 사용: 큰 PDF를 읽기 전에 페이지 수와 목차를 확인할 때 - 사용: scan_folder가 'B?'를 돌려줬고 스캔 여부를 알아야 할 때 - 사용하지 않음: 본문 내용이 필요할 때 → read_document
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| path | Yes | scan_folder가 돌려준 상대 경로, 또는 root 안의 절대 경로 |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| meta | Yes | 형식별 메타 (표 개수, 슬라이드 수 등) | |
| path | Yes | ||
| unit | Yes | 이 형식에서 블록 하나가 무엇인지 | |
| grade | Yes | **확정된** 추출가능등급. A=구조까지, B=본문만, C=텍스트 없음. scan_folder의 expected_grade와 달리 파일을 열어서 판정한 값입니다 | |
| stage | Yes | 분석 워크플로에서 지금 위치한 단계 | |
| status | Yes | 이 호출의 결과 상태 | |
| outline | Yes | 제목 트리. 없는 형식은 빈 목록 | |
| modified | Yes | 마지막 수정 시각 (ISO 8601) | |
| extension | Yes | ||
| size_bytes | Yes | ||
| text_chars | Yes | 본문 총 글자 수 (앵커 제외) | |
| unit_count | Yes | 원래 단위의 개수 (총 페이지·슬라이드 수 등) | |
| grade_reason | Yes | 그 등급으로 판정한 근거 | |
| next_actions | No | 이어서 호출하면 좋은 도구 목록 | |
| total_blocks | Yes | read_document로 읽을 수 있는 블록 수 | |
| outline_truncated | Yes | True면 제목이 너무 많아 잘렸습니다 | |
| blocks_needing_image | Yes | 텍스트가 없어 read_document_image로 판독해야 하는 블록의 앵커. 예: ['p3', 'p7']. 최대 50개까지 | |
| estimated_read_calls | Yes | 전체를 읽는 데 필요한 read_document 호출 횟수 (상한 기준 추정) |