MS-Lucidia-Voice-Gateway-MCP
Puerta de enlace de voz MS Lucidia MCP
Un servidor de Protocolo de Contexto de Modelo (MCP) que proporciona funciones de texto a voz y de voz a texto mediante los servicios de voz integrados de Windows. Este servidor aprovecha la API de Voz de Windows (SAPI) nativa mediante comandos de PowerShell, lo que elimina la necesidad de API o servicios externos.
Características
Texto a voz (TTS) con voces SAPI de Windows
Conversión de voz a texto (STT) mediante el reconocimiento de voz de Windows
Interfaz web sencilla para realizar pruebas
Sin dependencias de API externas
Utiliza capacidades nativas de Windows
Related MCP server: Edge TTS MCP
Prerrequisitos
Windows 10/11 con reconocimiento de voz habilitado
Node.js 16+
PowerShell
Instalación
Clonar el repositorio:
git clone https://github.com/ExpressionsBot/MS-Lucidia-Voice-Gateway-MCP.git
cd MS-Lucidia-Voice-Gateway-MCPInstalar dependencias:
npm installConstruir el proyecto:
npm run buildUso
Interfaz de prueba
Inicie el servidor de pruebas:
npm run testAbra
http://localhost:3000en su navegadorUtilice la interfaz web para probar las capacidades TTS y STT
Herramientas disponibles
texto a voz
Convierte texto en voz mediante Windows SAPI.
Parámetros:
text(obligatorio): El texto que se convertirá a vozvoice(opcional): La voz a utilizar (por ejemplo, "Microsoft David Desktop")speed(opcional): Velocidad de voz de 0,5 a 2,0 (predeterminado: 1,0)
Ejemplo:
fetch('http://localhost:3000/tts', {
method: 'POST',
headers: { 'Content-Type': 'application/json' },
body: JSON.stringify({
text: "Hello, this is a test",
voice: "Microsoft David Desktop",
speed: 1.0
})
});voz a texto
Graba audio y lo convierte en texto mediante el reconocimiento de voz de Windows.
Parámetros:
duration(opcional): Duración de la grabación en segundos (predeterminado: 5, máximo: 60)
Ejemplo:
fetch('http://localhost:3000/stt', {
method: 'POST',
headers: { 'Content-Type': 'application/json' },
body: JSON.stringify({
duration: 5
})
}).then(response => response.json())
.then(data => console.log(data.text));Solución de problemas
Asegúrese de que el reconocimiento de voz de Windows esté habilitado:
Abrir la configuración de Windows
Vaya a Tiempo y lenguaje > Habla
Habilitar el reconocimiento de voz
Comprobar voces disponibles:
Abra PowerShell y ejecute: GXP7
Prueba de reconocimiento de voz:
Abrir Reconocimiento de voz en la configuración de Windows
Ejecute el asistente de configuración si aún no lo ha hecho
Comprueba que Windows puede reconocer tu voz
Contribuyendo
Bifurcar el repositorio
Crea tu rama de funciones
Confirme sus cambios
Empujar hacia la rama
Crear una nueva solicitud de extracción
Licencia
Instituto Tecnológico de Massachusetts (MIT)
This server cannot be deployed
Maintenance
Related MCP Connectors
MCP server for Text-to-Speech
MCP server for Speech-to-Text
MCP server exposing the AceDataCloud Fish Audio API (text-to-speech with voice conditioning)
AI voice generation: text-to-speech and voice cloning from any MCP client.
Related MCP Servers
- AlicenseBqualityDmaintenanceA Model Context Protocol server that provides text-to-speech functionality for AI agents using Microsoft Edge's text-to-speech technology, supporting multiple voices, languages, and voice customization.28MIT
- AlicenseNot gradedqualityDmaintenanceAn MCP server that converts text into lifelike speech using Microsoft Edge's Text-to-Speech service, supporting customizable voice, rate, volume, and pitch.4MIT
- FlicenseNot gradedqualityDmaintenanceA lightweight MCP server that provides offline text-to-speech via native OS speech engines. It allows AI assistants to speak task summaries instantly with no network calls.-
- AlicenseAqualityAmaintenanceText-to-speech MCP server that enables AI assistants to read text aloud on the user's computer using Windows SAPI, with no API key or cloud service required.144 PyPI1MIT