mcp-kokoro-tts
mcp-kokoro-tts
Servidor MCP de texto a voz Kokoro-82M local. Cuando tu agente llama a speak, sintetiza el habla y la reproduce en tu máquina para que puedas oír hablar al harness.
Funciona con cualquier cliente MCP: Claude Desktop, Claude Code, Cursor, VS Code, opencode, Cline y más. Un bloque de configuración corto, sin claves API: la síntesis se ejecuta localmente con Kokoro-82M.
En el primer inicio, el servidor aprovisiona dos cosas que no están en PyPI: los pesos de Kokoro-82M (~312 MB) en una caché local, y el modelo de inglés de spaCy (en_core_web_sm) en el mismo entorno de Python en el que se ejecuta el servidor. Esa segunda instalación es necesaria porque el pipeline G2P de Kokoro carga spaCy, y un entorno uvx / uv tool no tendrá el modelo a menos que este paquete lo coloque allí.
Instalación
Añade a la configuración MCP de tu cliente:
{
"mcpServers": {
"mcp-kokoro-tts": {
"command": "uvx",
"args": ["mcp-kokoro-tts"]
}
}
}Requiere Python 3.12 y uv. El primer inicio del servidor aprovisiona los pesos de Kokoro y el modelo de inglés de spaCy automáticamente.
Para descargar ambos previamente sin iniciar el servidor MCP:
uvx mcp-kokoro-tts-provisionRelated MCP server: MCP TTS Server
Haz que el agente lo llame
Añade una línea a tu AGENTS.md / CLAUDE.md / prompt del sistema:
When the user wants to hear something spoken aloud, call the `speak` tool with clear, natural text.Herramientas
speak
Sintetiza el habla, escribe un archivo WAV y lo reproduce localmente.
Parámetro | Requerido | Descripción |
| sí | Texto a hablar (máx. 500 caracteres) |
| no | Identificador de voz (p. ej. |
| no | Multiplicador de velocidad de reproducción (por defecto |
list_voices
Lista las voces Kokoro disponibles y la predeterminada seleccionada actualmente.
Elegir tu voz
Orden de resolución:
Variable de entorno
TTS_VOICE— identificador de voz o ruta absoluta.ptUn archivo en la carpeta
voices/del paquete cuyo nombre comience condefaultPrimer archivo
.ptenvoices/(alfabético)La voz
af_heartincluida en el modelo
{
"mcpServers": {
"mcp-kokoro-tts": {
"command": "uvx",
"args": ["mcp-kokoro-tts"],
"env": {
"TTS_VOICE": "af_heart"
}
}
}
}Variables de entorno
Variable | Descripción |
| Identificador de voz predeterminado o ruta absoluta |
| Anula el directorio de caché del modelo |
| Anula el directorio de caché del hub de Hugging Face |
| Directorio para los archivos WAV generados |
| Establecer a |
| Token opcional de Hugging Face para descargas más rápidas |
Plataformas
SO | Síntesis | Reproducción |
macOS | sí |
|
Linux | sí |
|
Windows | sí | PowerShell |
espeak-ng es opcional. El inglés funciona sin él; instálalo para una mejor cobertura de palabras fuera de vocabulario y algunos idiomas no ingleses.
Publicación
Etiquetar una versión ejecuta publish.yml de GitHub Actions, que sube a PyPI y luego al Registro MCP.
La publicación en PyPI usa el secreto del repositorio PYPI_TOKEN (un token de API de PyPI). La publicación confiable de GitHub también se puede configurar en el proyecto de PyPI; este flujo de trabajo se autentica con el token para que un primer lanzamiento no dependa de la coincidencia de publicador pendiente.
Lanzamiento
Incrementa
versionenpyproject.toml(yserver.jsonsi aún no estás etiquetando)Confirma y etiqueta:
git tag v0.1.2 && git push origin v0.1.2GitHub Actions ejecuta
publish.yml:release— verificación de tipos, pruebas, compilación de wheel/sdistpypi-publish— subir a PyPI conPYPI_TOKENmcp-registry— OIDC → Registro MCP (después de que PyPI tenga éxito)
Desarrollo
cd mcps-tts
python3.12 -m venv .venv
source .venv/bin/activate
pip install -e ".[dev]"
pyright
pytest
python -m mcp_kokoro_ttsLicencia
Apache-2.0. Consulta LICENSE y NOTICE. Los pesos del modelo Kokoro-82M se descargan por separado bajo su licencia Apache-2.0.
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Tools
Related MCP Servers
- AlicenseCqualityDmaintenanceEnables users to convert text into high-quality audio by accessing the OpenAI Text-to-Speech API. It supports customizable model selection and voice options for synthesized speech generation via the MCP protocol.1MIT
- FlicenseNot gradedqualityDmaintenanceProvides text-to-speech conversion through a unified MCP interface, supporting both local Kokoro and cloud OpenAI TTS engines with streaming audio, voice selection, and customization via natural language instructions.7
- AlicenseAqualityCmaintenanceMCP server for text-to-speech using macOS say command, enabling speech synthesis, audio file generation, and voice management.512MIT

leanvox-mcpofficial
AlicenseNot gradedqualityDmaintenanceEnables text-to-speech generation, voice cloning, dialogue creation, and other TTS operations through natural language in MCP-compatible AI assistants.16MIT
Related MCP Connectors
MCP server exposing the AceDataCloud Fish Audio API (text-to-speech with voice conditioning)
Hosted pay-per-use TTS: 54 neural voices, 9 languages incl. Brazilian Portuguese. $10 free credits.
Generate Suno AI music (v5.5) from any MCP client. Async; billed only on success.
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/mrfqcentic/mcp-kokoro-tts'
If you have feedback or need assistance with the MCP directory API, please join our Discord server