Skip to main content
Glama

PDF-процессор MCP-сервер

Сервер Model Context Protocol (MCP) для обработки PDF-документов с расширенными функциями, включая извлечение уравнений LaTeX. Этот сервер позволяет Клоду извлекать, обрабатывать и извлекать информацию из PDF-документов, включая математические уравнения LaTeX.

Функции

  • Извлечение PDF-файлов из URL-адресов

  • Извлечение текста из PDF-файлов

  • Распознавание и извлечение уравнений LaTeX

  • Интеграция с Клодом через MCP

Related MCP server: MCP PDF Reader

Установка

Стандартная установка

pip install -e .

Установка для Claude Desktop/Claude Code

Чтобы использовать этот MCP-сервер с Claude Desktop или Claude Code:

  1. Установите инструменты MCP CLI, если они еще не установлены:

    pip install "mcp[cli]"
  2. Установите сервер с помощью инструмента MCP CLI:

    mcp install /path/to/pdf_tool_server.py --with-editable /path/to/mcp_pdf_processor

    Например, если вы клонировали этот репозиторий в ~/mcp_pdf_processor :

    mcp install ~/mcp_pdf_processor/pdf_tool_server.py --with-editable ~/mcp_pdf_processor
  3. Для разработки с помощью MCP Inspector:

    mcp dev /path/to/pdf_tool_server.py --with-editable /path/to/mcp_pdf_processor
  4. В Claude Desktop теперь вы можете использовать сервер PDF_TOOLS в своих диалогах с помощью следующих команд:

    /mcp PDF_TOOLS fetch_pdf url=https://example.com/document.pdf
    /mcp PDF_TOOLS process_pdf hash_id=<HASH_ID> extract_latex=true
    /mcp PDF_TOOLS read_processed_pdf filename=<FILENAME>

Использование

Работает автономно

python pdf_tool_server.py

Переменные среды

  • OUTPUT_DIR : Каталог для хранения обработанных PDF-файлов (по умолчанию: llm_output )

  • PYTHONPATH : Укажите каталог, содержащий пакет mcp_pdf_processor

Использование с Клодом

После регистрации сервера вы можете попросить Клода:

  • «Загрузить и проанализировать PDF-файл по адресу [URL]»

  • «Извлечь уравнения LaTeX из PDF-файла по адресу [URL]»

  • «Кратко изложите содержание PDF-файла по адресу [URL]»

Требования

Для сервера требуются следующие основные зависимости:

  • Python 3.9 или выше

  • pymupdf : обработка PDF-файлов и извлечение текста

  • mcp : поддержка протокола контекста модели

  • pydantic : Проверка и сериализация данных

  • aiohttp : Асинхронный HTTP-клиент/сервер

  • torch : Для извлечения уравнений LaTeX (необязательно)

  • pix2tex : Для распознавания уравнений LaTeX (необязательно)

Полный список зависимостей и требований к версиям см. в pyproject.toml

Примеры использования

Вот полный пример рабочего процесса использования PDF-процессора с Claude Desktop:

# 1. Fetch a PDF without reading it
/mcp PDF_TOOLS fetch_pdf url=https://arxiv.org/pdf/2505.05522

# This returns a hash_id, which you'll use in the next step

# 2. Process the PDF with LaTeX extraction
/mcp PDF_TOOLS process_pdf hash_id=<HASH_ID> extract_latex=true

# This returns a filename for the processed output

# 3. Read the processed content
/mcp PDF_TOOLS read_processed_pdf filename=<FILENAME>

# Now Claude can analyze the PDF content, including any LaTeX equations

Лицензия

Массачусетский технологический институт

A
license - permissive license
-
quality - not tested
D
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

  • F
    license
    A
    quality
    -
    maintenance
    A Model Context Protocol server that extracts and processes content from PDF documents, providing text extraction, metadata retrieval, page-level processing, and PDF validation capabilities.
    4
    1
  • A
    license
    A
    quality
    C
    maintenance
    A Model Context Protocol server that enables the extraction of text, metadata, and embedded images from PDF files. It provides tools for searching text with context, reading specific pages, and counting total pages within a document.
    7
    30
    1
    MIT
  • A
    license
    -
    quality
    D
    maintenance
    A high-performance Model Context Protocol server that enables AI agents to extract text, images, and metadata from PDF documents using parallel processing. It features intelligent Y-coordinate content ordering to preserve natural reading flow and supports both local files and URL-based sources.
    17
    MIT

View all related MCP servers

Related MCP Connectors

  • A comprehensive Model Context Protocol (MCP) server that enables AI assistants to interact with yo…

  • A Model Context Protocol server for Wix AI tools

  • Generate PDFs from templates via AI chat. Works with Claude, ChatGPT, Cursor, and any MCP client.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/MichaelLevinson/mcp_pdf_processor'

If you have feedback or need assistance with the MCP directory API, please join our Discord server