dual_extract
Extract structured fields, tables, and formulas from local PDFs using dual text-layout and vision extraction, with fusion adjudication to validate results.
Instructions
dual_extract tool:双路融合主入口(M3,T03)。
V2.0(additive):新增可选 verify_pages —— 调用级显式指定 OvisOCR2
校验页(信号②;未指定/未启用 → 触发规则自行判定,默认零调用)。
Args:
pdf_path: PDF 路径(必填)。
fields: 字段键(str | list[str] | dict;必填,禁止空)。
pages: 页号(int | list[int] | None;1-based)。
model: 视觉模型名(可选,默认 Settings.ollama_model)。
think: 视觉路 thinking 开关(bool | None;None → Settings.ollama_think)。
field_types: {字段键: 字段类型}(可选;未指定按值形态推断)。
verify_pages: 页号(int | list[int] | None;1-based;OvisOCR2 校验页)。
Returns: 结构化 JSON 文本(ExtractionOutput)。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| model | No | ||
| pages | No | ||
| think | No | ||
| fields | No | ||
| pdf_path | Yes | ||
| field_types | No | ||
| verify_pages | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |