Extract PDF text by page
pdf_extractExtract text from a digital PDF into page-numbered JSON with SHA-256 hashes. No account or API key. 0.005 USDC on Base per successful document via x402. Maximum 2 MiB and 25 pages. No OCR, summaries, URL fetching, or verification of document claims.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| pdf_base64 | Yes | Standard padded base64 of PDF bytes, maximum 2097152 bytes. No URL or data-URI prefix. |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| pages | Yes | ||
| warnings | Yes | ||
| page_count | Yes | ||
| provenance | Yes | ||
| schema_version | Yes | ||
| character_count | Yes | ||
| document_sha256 | Yes |