analyze_folder
Extract text from all PDF, DOCX, PPTX, SVG, and PNG files in a folder at once, returning a report with per-file status and errors. Handles partial failures and file limits transparently.
Instructions
폴더 안의 모든 대상 파일(pdf/docx/pptx/svg/png)을 한 번에 추출해 리포트로 반환합니다.
파일마다 read_document/read_image_text를 따로 호출하지 않아도 되는 배치 도구입니다. 한 파일이 실패해도 나머지 파일 처리는 계속되며, 실패 이유는 파일별로 남습니다. 파일 수가 max_files를 넘으면 앞쪽부터 max_files개만 처리하고, 넘겨받지 못한 개수는 skipped_due_to_limit로 투명하게 알려줍니다(조용히 누락되지 않습니다).
Returns:
AnalyzeFolderResponse: reports[]의 각 항목은 status(OK/ERROR)와 함께
text 또는 error를 담습니다. status가 PARTIAL이면 일부 실패했거나(failed>0)
상한 때문에 스킵된 파일(skipped_due_to_limit>0)이 있다는 뜻입니다.
Examples: - 사용: "이 폴더 문서들 다 요약해줘", "폴더 구조 분석하고 내용도 정리해줘" - 사용하지 않음: 파일 목록만 필요할 때 → scan_folder - 사용하지 않음: 특정 파일 하나만 자세히 → read_document / read_image_text
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| max_files | No | 이번 호출에서 실제로 추출을 시도할 최대 파일 수(컨텍스트/시간 보호용 상한). 초과분은 시도조차 하지 않고 skipped_due_to_limit로 개수를 알려줍니다. | |
| recursive | No | 하위 폴더까지 재귀적으로 탐색할지 여부 | |
| extensions | No | 필터링할 확장자 목록. 생략하면 pdf/docx/pptx/svg/png 전체를 대상으로 함 | |
| folder_path | Yes | 분석할 폴더의 절대 경로 | |
| max_chars_per_file | No | 파일당 반환할 최대 문자 수(컨텍스트 보호용 절단) |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| failed | Yes | ||
| folder | Yes | ||
| status | Yes | OK 또는 PARTIAL 등 처리 결과 상태 | |
| reports | Yes | ||
| succeeded | Yes | ||
| total_files | Yes | 실제로 추출을 시도한 파일 수 (= len(reports)) | |
| next_actions | No | ||
| total_matched | Yes | 조건에 맞는 전체 파일 수(상한 적용 전) | |
| skipped_due_to_limit | Yes | max_files 상한 때문에 시도조차 하지 않은 파일 수 |