pdf_extract_images
Extract embedded figures and photos from PDFs to disk files. Specify page ranges and skip small icons for focused results.
Instructions
Extract embedded raster images (figures, photos) from a PDF to files on disk. Returns the file list; use image_view afterwards to look at specific ones.
Args: source: Local file path or direct http(s) URL to a PDF. pages: Page selection like '1-5'. Empty = whole document. output_dir: Directory for extracted images. Defaults to ~/Downloads/openmedia/. min_dimension: Skip images smaller than this in both dimensions (filters icons/bullets, default 64).
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| pages | No | ||
| source | Yes | ||
| output_dir | No | ||
| min_dimension | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| result | Yes |