PDF一键救援
rescue_pdfDiagnose and extract text from PDFs, automatically choosing foreground or resumable background jobs, with real-time progress, quality audit, and page evidence.
Instructions
首选入口:直接处理用户关于单个PDF的请求,不要让用户选择内部工具。传入PDF路径和用户原话,会自动诊断、规划,并按文档类型和预计耗时完成前台提取或启动可恢复后台任务;也可用同一入口查询进度、质检、恢复任务和查看页面证据。前台提取时每页实时推送进度(页数、百分比、剩余时间)。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| mode | No | 识别质量。默认 book-balanced;除非用户要求速度、最高质量或取证级,不必询问。 | book-balanced |
| path | No | 待处理的 PDF 路径或包含 PDF 的目录。目录会作为批量后台任务处理;查询已有任务时可不填。 | |
| job_dir | No | 已有救援任务目录。查询进度、质检、恢复或查看页面证据时使用。 | |
| request | No | 用户的原始诉求,尽量原样传入。服务用它自动选择流程;不要先问用户选择操作。 | |
| password | No | 仅用于本次密码保护 PDF 调用;不会写入任务记录或后台命令。 | |
| workflow | No | 默认 auto,根据 request 自动判断。仅在调用方已明确知道生命周期步骤时指定。 | auto |
| execution | No | 提取执行方式。默认 auto:短任务前台完成,长 OCR 任务自动后台运行。 | auto |
| max_pages | No | 仅处理前 N 页;用户要求试跑、样本或明确页数时填写。 | |
| output_dir | No | 结果目录;未提供时自动创建在 PDF 同级的 pdf_rescue_output 下。 | |
| page_number | No | 查看页面证据时的 1 起始页码;也会尝试从 request 中提取“第 N 页”。 | |
| evidence_format | No | 页面证据形式。默认 auto;用户提到图片、截图或渲染页时自动导出图片。 | auto |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
No arguments | |||