Mistral OCR MCP connector
Click on "Deploy Server".
Wait a few minutes for the server to deploy. Once ready, it will show a "Started" state.
In the chat, type
@followed by the MCP server name and your instructions, e.g., "@Mistral OCR MCP connectorраспознай https://example.com/scan.pdf и верни Markdown"
That's it! The server will respond to your query, and you can continue using it as needed.
Here is a step-by-step guide with screenshots.
Mistral OCR MCP connector
Удалённый MCP-сервер (Streamable HTTP + OAuth 2.1), который распознаёт сканы PDF и изображения через Mistral OCR и отдаёт результат в трёх видах: PDF с невидимым текстовым слоем (страницы оригинала сохраняются), Markdown и JSON с координатами блоков. Опционально распознанный текст вычитывает Mistral Large и исправляет ошибки OCR.
Как это устроено
Claude (web / desktop / Cowork / Claude Code)
│ MCP over HTTPS, Bearer-токен OAuth
▼
app/server.py ── инструменты MCP ──┐
│ │
│ /upload /files /login │ app/ocr.py: Mistral OCR → JSON → Markdown → searchable PDF
▼ │ → (опция) Mistral Large: вычитка
веб-консоль (drag-and-drop) │
│ ▼
volume /data ← документы, задания, результаты; удаление через RETENTION_DAYSИнструменты MCP:
Инструмент | Назначение |
| Запуск OCR по |
| Статус и результат задания (опрашивается для длинных документов) |
| Постраничное чтение текста (Markdown) или блоков с координатами |
| Загруженные документы и последние задания |
| Одноразовый токен и готовая команда |
| Удаление документа и результатов |
Как файл попадает на сервер:
Веб-консоль по адресу сервера: вход по паролю, перетаскивание файла, получение
doc_…. Дальше в Claude: «распознай doc_…».Публичный URL:
ocr_document("https://…/file.pdf").Из агента с shell (Cowork, Claude Code):
create_upload_token→ выполнитьcurl→ocr_document(doc_id).
Related MCP server: Vision-OCR-MCP
Переменные окружения
Переменная | Обязательна | Описание |
| да | ключ Mistral (OCR и вычитка) |
| да | пароль входа (OAuth-подключение из Claude и веб-консоль) |
| да | внешний адрес сервиса, например |
| нет | каталог хранения, по умолчанию |
| нет | срок хранения файлов и результатов, по умолчанию 7 |
| нет | по умолчанию |
| нет | по умолчанию |
| нет | предел размера файла, по умолчанию 200 |
| нет | ключ подписи ссылок и сессий; если не задан, генерируется и хранится в |
Развёртывание на Railway
Создать сервис из этого репозитория (Dockerfile определяется автоматически,
railway.tomlзадаёт healthcheck/health).Подключить volume к пути
/data.Задать переменные
MISTRAL_API_KEY,ADMIN_PASSWORD,PUBLIC_URL.Сгенерировать домен. Адрес MCP:
https://<домен>/mcp.
Подключение в Claude
Web и desktop: Настройки → Коннекторы → Добавить пользовательский коннектор → URL https://<домен>/mcp. При подключении откроется страница входа сервера, ввести ADMIN_PASSWORD.
Claude Code: claude mcp add --transport http mistral-ocr https://<домен>/mcp, затем /mcp для авторизации.
Локальный запуск
python -m venv .venv && . .venv/bin/activate
pip install -r requirements.txt
export MISTRAL_API_KEY=… ADMIN_PASSWORD=… PUBLIC_URL=http://127.0.0.1:8080 DATA_DIR=./data
uvicorn app.server:app --port 8080Ограничения
Mistral OCR возвращает координаты на уровне абзацев (блоков), а не слов. Текстовый слой размещается по прямоугольнику блока с подбором размера шрифта, поэтому поиск и копирование работают по всему тексту, а подсветка найденного фрагмента совпадает с оригиналом с точностью до строки.
This server cannot be deployed
Maintenance
Related MCP Connectors
Verified OCR with per-value coordinates, plus a workspace agents can file documents into and query.
Arabic-first OCR, translation and document extraction. First call mints a free trial key.
- DatanemOAuthcom.datanem
Turn PDFs, scans and photos into a queryable database. Invoices, CVs, receipts, in bulk.
Read PDFs and images as markdown or text, with exact costs and hard spend caps. $0.75/1k pages.
Related MCP Servers
- AlicenseNot gradedqualityDmaintenanceEnables AI-driven PDF document processing including PDF to Markdown conversion, intelligent text and table extraction, image extraction, format conversion between PDF/Word/Markdown, batch processing, and fuzzy search - optimized for LLM context and RAG workflows.2MIT
- FlicenseNot gradedqualityDmaintenanceEnables OCR on images and PDFs, including full-page OCR, region OCR by description or bounding box, and caching with summary capabilities.-
- FlicenseBqualityBmaintenanceEnables document OCR processing via OcrPlane APIs, supporting document parsing, asynchronous polling, markdown extraction, and task management.7-
- AlicenseAqualityDmaintenanceProvides structured OCR with verified bounding boxes using the space-ocr API. Allows extraction of structured fields from document images and listing of built-in templates.247 npmMIT