extract_segments
Extract all text segments from a PDF for translation in one pass, preserving document context. Returns a session directory to check completion asynchronously.
Instructions
PDF 파일에서 번역 대상 세그먼트를 추출합니다.
백그라운드에서 비동기로 실행됩니다. 반환된 session_dir로 check_extraction_status를 호출하여 완료 여부를 확인하세요.
Args:
file: PDF 파일의 로컬 절대 경로. 예: /Users/username/Downloads/paper.pdf
주의: 반드시 사용자가 메시지에 입력한 로컬 경로를 사용하세요.
첨부 파일의 내부 경로(/mnt/user-data/uploads/...)는 사용할 수 없습니다.
lang_in: 원본 언어 코드 (기본값: en)
lang_out: 번역 대상 언어 코드 (기본값: ko)
output_dir: 출력 디렉토리 경로. 비어 있으면 입력 PDF와 같은 디렉토리에 저장.
pages: 번역할 페이지 범위. 비어 있으면 전체 페이지.
형식: '1-7,10' (17, 10페이지), '-5' (15), '3-' (3~끝).
참고문헌 등 특정 페이지를 제외하고 싶을 때 사용하세요.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| file | Yes | ||
| pages | No | ||
| lang_in | No | en | |
| lang_out | No | ko | |
| output_dir | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |