klax_index_learning_material
Extract text from downloaded PDF/PPTX files and index each page for local search, skipping files already indexed by content hash.
Instructions
로컬에 이미 다운로드된 PDF/PPTX 파일을 읽어 페이지/슬라이드 단위로 텍스트를 추출하고 로컬 검색 인덱스에 반영합니다.
KLAS에는 어떤 것도 쓰지 않으며, klax_download_material로 받은 로컬 경로만 처리합니다. 동일 파일 내용(SHA256)이 이미 색인되어 있으면 재처리하지 않고 기존 결과를 반환합니다 (force_reindex=True로 강제 재처리 가능). PyMuPDF/python-pptx 미설치, 스캔본(텍스트 없음), 미지원 확장자는 각각 unsupported/needs_ocr 상태와 사유(error_reason)로 반환됩니다.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| title | No | ||
| semester | No | ||
| course_id | Yes | ||
| local_path | Yes | ||
| source_url | No | ||
| force_reindex | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |