mcp-kokoro-tts
mcp-kokoro-tts
Локальный MCP-сервер для синтеза речи на базе Kokoro-82M. Когда ваш агент вызывает speak, сервер синтезирует речь и воспроизводит её на вашем компьютере, чтобы вы могли слышать, как говорит обвязка.
Работает с любым MCP-клиентом: Claude Desktop, Claude Code, Cursor, VS Code, opencode, Cline и другими. Один короткий блок конфигурации, никаких API-ключей — синтез выполняется локально на основе Kokoro-82M.
При первом запуске сервер подготавливает два компонента, которых нет на PyPI: веса Kokoro-82M (~312 MB) — в локальный кэш, а английскую модель spaCy (en_core_web_sm) — в то же окружение Python, в котором запущен сервер. Второй компонент обязателен, потому что G2P-конвейер Kokoro загружает spaCy, а окружение uvx / uv tool не будет иметь модель, если этот пакет её не добавит.
Установка
Добавьте в MCP-конфигурацию вашего клиента:
{
"mcpServers": {
"mcp-kokoro-tts": {
"command": "uvx",
"args": ["mcp-kokoro-tts"]
}
}
}Требуются Python 3.12 и uv. При первом запуске сервер автоматически подготавливает веса Kokoro и английскую модель spaCy.
Чтобы заранее скачать и то и другое без запуска MCP-сервера:
uvx mcp-kokoro-tts-provisionRelated MCP server: MCP TTS Server
Как заставить агента вызывать этот инструмент
Добавьте одну строку в AGENTS.md / CLAUDE.md / системный промпт:
When the user wants to hear something spoken aloud, call the `speak` tool with clear, natural text.Инструменты
speak
Синтезирует речь, записывает WAV-файл и воспроизводит его локально.
Параметр | Обязательный | Описание |
| да | Текст для озвучивания (максимум 500 символов) |
| нет | Идентификатор голоса (например, |
| нет | Множитель скорости воспроизведения (по умолчанию |
list_voices
Перечисляет доступные голоса Kokoro и текущий выбранный голос по умолчанию.
Выбор голоса
Порядок определения:
Переменная окружения
TTS_VOICE— идентификатор голоса или абсолютный путь к.ptФайл в каталоге
voices/пакета, имя которого начинается сdefaultПервый файл
.ptвvoices/(в алфавитном порядке)Встроенный голос модели
af_heart
{
"mcpServers": {
"mcp-kokoro-tts": {
"command": "uvx",
"args": ["mcp-kokoro-tts"],
"env": {
"TTS_VOICE": "af_heart"
}
}
}
}Переменные окружения
Переменная | Описание |
| Идентификатор голоса по умолчанию или абсолютный путь к |
| Переопределяет каталог кэша моделей |
| Переопределяет каталог кэша Hugging Face Hub |
| Каталог для создаваемых WAV-файлов |
| Установите |
| Необязательный токен Hugging Face для более быстрой загрузки |
Платформы
ОС | Синтез | Воспроизведение |
macOS | да |
|
Linux | да |
|
Windows | да | PowerShell |
espeak-ng необязателен. Английский работает и без него; установите его для лучшего охвата слов вне словаря и для некоторых языков, отличных от английского.
Публикация
Тегирование версии запускает GitHub Actions publish.yml, который публикует в PyPI, а затем в MCP Registry.
Публикация в PyPI использует секрет репозитория PYPI_TOKEN (API-токен PyPI). На проекте PyPI можно также включить GitHub trusted publishing; в этом workflow аутентификация выполняется с помощью токена, поэтому первый релиз не зависит от сопоставления с отложенным издателем.
Релиз
Поднимите
versionвpyproject.toml(и вserver.json, если вы пока не тегируете)Сделайте коммит и тег:
git tag v0.1.2 && git push origin v0.1.2GitHub Actions запускает
publish.yml:release— проверка типов, тесты, сборка wheel/sdistpypi-publish— загрузка в PyPI сPYPI_TOKENmcp-registry— OIDC → MCP Registry (после успешного PyPI)
Разработка
cd mcps-tts
python3.12 -m venv .venv
source .venv/bin/activate
pip install -e ".[dev]"
pyright
pytest
python -m mcp_kokoro_ttsЛицензия
Apache-2.0. См. LICENSE и NOTICE. Веса модели Kokoro-82M загружаются отдельно по их лицензии Apache-2
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Tools
Related MCP Servers
- AlicenseCqualityDmaintenanceEnables users to convert text into high-quality audio by accessing the OpenAI Text-to-Speech API. It supports customizable model selection and voice options for synthesized speech generation via the MCP protocol.1MIT
- FlicenseNot gradedqualityDmaintenanceProvides text-to-speech conversion through a unified MCP interface, supporting both local Kokoro and cloud OpenAI TTS engines with streaming audio, voice selection, and customization via natural language instructions.7
- AlicenseAqualityCmaintenanceMCP server for text-to-speech using macOS say command, enabling speech synthesis, audio file generation, and voice management.512MIT

leanvox-mcpofficial
AlicenseNot gradedqualityDmaintenanceEnables text-to-speech generation, voice cloning, dialogue creation, and other TTS operations through natural language in MCP-compatible AI assistants.16MIT
Related MCP Connectors
MCP server exposing the AceDataCloud Fish Audio API (text-to-speech with voice conditioning)
Hosted pay-per-use TTS: 54 neural voices, 9 languages incl. Brazilian Portuguese. $10 free credits.
Generate Suno AI music (v5.5) from any MCP client. Async; billed only on success.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/mrfqcentic/mcp-kokoro-tts'
If you have feedback or need assistance with the MCP directory API, please join our Discord server