Mistral OCR MCP connector
Click on "Deploy Server".
Wait a few minutes for the server to deploy. Once ready, it will show a "Started" state.
In the chat, type
@followed by the MCP server name and your instructions, e.g., "@Mistral OCR MCP connectorраспознай https://example.com/scan.pdf и верни Markdown"
That's it! The server will respond to your query, and you can continue using it as needed.
Here is a step-by-step guide with screenshots.
Mistral OCR MCP connector
Удалённый MCP-сервер (Streamable HTTP + OAuth 2.1), который распознаёт сканы PDF и изображения через Mistral OCR и отдаёт результат в трёх видах: PDF с невидимым текстовым слоем (страницы оригинала сохраняются), Markdown и JSON с координатами блоков. Опционально распознанный текст вычитывает Mistral Large и исправляет ошибки OCR.
Как это устроено
Claude (web / desktop / Cowork / Claude Code)
│ MCP over HTTPS, Bearer-токен OAuth
▼
app/server.py ── инструменты MCP ──┐
│ │
│ /upload /files /login │ app/ocr.py: Mistral OCR → JSON → Markdown → searchable PDF
▼ │ → (опция) Mistral Large: вычитка
веб-консоль (drag-and-drop) │
│ ▼
volume /data ← документы, задания, результаты; удаление через RETENTION_DAYSИнструменты MCP:
Инструмент | Назначение |
| Запуск OCR по |
| Статус и результат задания (опрашивается для длинных документов) |
| Постраничное чтение текста (Markdown) или блоков с координатами |
| Загруженные документы и последние задания |
| Одноразовый токен и готовая команда |
| Удаление документа и результатов |
Как файл попадает на сервер:
Веб-консоль по адресу сервера: вход по паролю, перетаскивание файла, получение
doc_…. Дальше в Claude: «распознай doc_…».Публичный URL:
ocr_document("https://…/file.pdf").Из агента с shell (Cowork, Claude Code):
create_upload_token→ выполнитьcurl→ocr_document(doc_id).
Related MCP server: Vision-OCR-MCP
Переменные окружения
Переменная | Обязательна | Описание |
| да | ключ Mistral (OCR и вычитка) |
| да | пароль входа (OAuth-подключение из Claude и веб-консоль) |
| да | внешний адрес сервиса, например |
| нет | каталог хранения, по умолчанию |
| нет | срок хранения файлов и результатов, по умолчанию 7 |
| нет | по умолчанию |
| нет | по умолчанию |
| нет | предел размера файла, по умолчанию 200 |
| нет | ключ подписи ссылок и сессий; если не задан, генерируется и хранится в |
Развёртывание на Railway
Создать сервис из этого репозитория (Dockerfile определяется автоматически,
railway.tomlзадаёт healthcheck/health).Подключить volume к пути
/data.Задать переменные
MISTRAL_API_KEY,ADMIN_PASSWORD,PUBLIC_URL.Сгенерировать домен. Адрес MCP:
https://<домен>/mcp.
Подключение в Claude
Web и desktop: Настройки → Коннекторы → Добавить пользовательский коннектор → URL https://<домен>/mcp. При подключении откроется страница входа сервера, ввести ADMIN_PASSWORD.
Claude Code: claude mcp add --transport http mistral-ocr https://<домен>/mcp, затем /mcp для авторизации.
Локальный запуск
python -m venv .venv && . .venv/bin/activate
pip install -r requirements.txt
export MISTRAL_API_KEY=… ADMIN_PASSWORD=… PUBLIC_URL=http://127.0.0.1:8080 DATA_DIR=./data
uvicorn app.server:app --port 8080Ограничения
Mistral OCR возвращает координаты на уровне абзацев (блоков), а не слов. Текстовый слой размещается по прямоугольнику блока с подбором размера шрифта, поэтому поиск и копирование работают по всему тексту, а подсветка найденного фрагмента совпадает с оригиналом с точностью до строки.
This server cannot be deployed
Maintenance
Related MCP Connectors
Convert PDF, Word, Excel and scanned documents to Markdown, tables and RAG chunks. OCR.
OCR text from images and scanned PDFs; pay-per-event via your Apify account.
1Verified OCR with per-value coordinates, plus a workspace agents can file documents into and query.
Arabic-first OCR, translation and document extraction. First call mints a free trial key.
Related MCP Servers
- AlicenseNot gradedqualityCmaintenanceEnables AI-driven PDF document processing including PDF to Markdown conversion, intelligent text and table extraction, image extraction, format conversion between PDF/Word/Markdown, batch processing, and fuzzy search - optimized for LLM context and RAG workflows.2MIT
- FlicenseNot gradedqualityDmaintenanceEnables OCR on images and PDFs, including full-page OCR, region OCR by description or bounding box, and caching with summary capabilities.-
- FlicenseBqualityDmaintenanceEnables document OCR processing via OcrPlane APIs, supporting document parsing, asynchronous polling, markdown extraction, and task management.7-
- AlicenseAqualityDmaintenanceProvides structured OCR with verified bounding boxes using the space-ocr API. Allows extraction of structured fields from document images and listing of built-in templates.247 npmMIT