Skip to main content
Glama

PDF-Prozessor MCP Server

Ein Model Context Protocol (MCP)-Server zur Verarbeitung von PDF-Dokumenten mit erweiterten Funktionen, einschließlich der Extraktion von LaTeX-Gleichungen. Dieser Server ermöglicht es Claude, Informationen aus PDF-Dokumenten abzurufen, zu verarbeiten und zu extrahieren, einschließlich mathematischer LaTeX-Gleichungen.

Merkmale

  • PDF-Abruf von URLs

  • Textextraktion aus PDFs

  • LaTeX-Gleichungserkennung und -extraktion

  • Integration mit Claude über MCP

Related MCP server: MCP PDF Reader

Installation

Standardinstallation

pip install -e .

Installation für Claude Desktop/Claude Code

So verwenden Sie diesen MCP-Server mit Claude Desktop oder Claude Code:

  1. Installieren Sie die MCP CLI-Tools, falls sie noch nicht installiert sind:

    pip install "mcp[cli]"
  2. Installieren Sie den Server mit dem MCP-CLI-Tool:

    mcp install /path/to/pdf_tool_server.py --with-editable /path/to/mcp_pdf_processor

    Wenn Sie dieses Repository beispielsweise nach ~/mcp_pdf_processor geklont haben:

    mcp install ~/mcp_pdf_processor/pdf_tool_server.py --with-editable ~/mcp_pdf_processor
  3. Für die Entwicklung mit dem MCP Inspector:

    mcp dev /path/to/pdf_tool_server.py --with-editable /path/to/mcp_pdf_processor
  4. In Claude Desktop können Sie jetzt den PDF_TOOLS-Server mit diesen Befehlen in Ihren Konversationen verwenden:

    /mcp PDF_TOOLS fetch_pdf url=https://example.com/document.pdf
    /mcp PDF_TOOLS process_pdf hash_id=<HASH_ID> extract_latex=true
    /mcp PDF_TOOLS read_processed_pdf filename=<FILENAME>

Verwendung

Standalone-Betrieb

python pdf_tool_server.py

Umgebungsvariablen

  • OUTPUT_DIR : Verzeichnis zum Speichern verarbeiteter PDFs (Standard: llm_output )

  • PYTHONPATH : Auf das Verzeichnis einstellen, das das Paket mcp_pdf_processor enthält

Verwendung mit Claude

Wenn der Server registriert ist, können Sie Claude bitten:

  • „PDF unter [URL] abrufen und analysieren“

  • „LaTeX-Gleichungen aus dem PDF unter [URL] extrahieren“

  • „Fassen Sie den Inhalt des PDFs unter [URL] zusammen.“

Anforderungen

Der Server erfordert die folgenden Hauptabhängigkeiten:

  • Python 3.9 oder höher

  • pymupdf : PDF-Verarbeitung und Textextraktion

  • mcp : Model Context Protocol-Unterstützung

  • pydantic : Datenvalidierung und -serialisierung

  • aiohttp : Asynchroner HTTP-Client/Server

  • torch : Zur Extraktion von LaTeX-Gleichungen (optional)

  • pix2tex : Zur LaTeX-Gleichungserkennung (optional)

Die vollständige Liste der Abhängigkeiten und Versionsanforderungen finden Sie in pyproject.toml .

Anwendungsbeispiele

Hier ist ein vollständiger Beispiel-Workflow für die Verwendung des PDF-Prozessors mit Claude Desktop:

# 1. Fetch a PDF without reading it
/mcp PDF_TOOLS fetch_pdf url=https://arxiv.org/pdf/2505.05522

# This returns a hash_id, which you'll use in the next step

# 2. Process the PDF with LaTeX extraction
/mcp PDF_TOOLS process_pdf hash_id=<HASH_ID> extract_latex=true

# This returns a filename for the processed output

# 3. Read the processed content
/mcp PDF_TOOLS read_processed_pdf filename=<FILENAME>

# Now Claude can analyze the PDF content, including any LaTeX equations

Lizenz

MIT

A
license - permissive license
-
quality - not tested
D
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    A
    quality
    -
    maintenance
    A Model Context Protocol server that extracts and processes content from PDF documents, providing text extraction, metadata retrieval, page-level processing, and PDF validation capabilities.
    4
    1
  • A
    license
    A
    quality
    C
    maintenance
    A Model Context Protocol server that enables the extraction of text, metadata, and embedded images from PDF files. It provides tools for searching text with context, reading specific pages, and counting total pages within a document.
    7
    30
    1
    MIT
  • A
    license
    -
    quality
    D
    maintenance
    A high-performance Model Context Protocol server that enables AI agents to extract text, images, and metadata from PDF documents using parallel processing. It features intelligent Y-coordinate content ordering to preserve natural reading flow and supports both local files and URL-based sources.
    17
    MIT

View all related MCP servers

Related MCP Connectors

  • A comprehensive Model Context Protocol (MCP) server that enables AI assistants to interact with yo…

  • A Model Context Protocol server for Wix AI tools

  • Generate PDFs from templates via AI chat. Works with Claude, ChatGPT, Cursor, and any MCP client.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/MichaelLevinson/mcp_pdf_processor'

If you have feedback or need assistance with the MCP directory API, please join our Discord server