Skip to main content
Glama

speak

Pídele a Claude que lea su respuesta en voz alta.

No es un volcado de texto a voz de la respuesta cruda. Tú dices «léemelo de nuevo simplemente» y Claude reescribe lo que dijo como un guion hablado breve y lo reproduce. El guion nunca aparece en el chat. Es una conversación entre tú y el modelo, con el texto fuera de tu camino.

Funciona en Claude Code hoy. La mitad de reproducción es un servidor MCP simple, así que también se integra en Claude Desktop, Cursor o cualquier cliente MCP.

Qué obtienes

  • Servidor MCP speak con las herramientas speak, stop, pause, resume, back, skip, add_pronunciation, list_pronunciations, list_voices, set_default

  • Superposición flotante en macOS mientras Claude habla: una pequeña píldora sobre cada ventana con una forma de onda en vivo, retroceder una frase, saltar una frase, pausar y reanudar desde el punto exacto, detener

  • Habilidad /speak para Claude Code, con estilos: simple (predeterminado), brief, decisions, full, eli5

  • Auto-habla: un hook Stop que lee un guion brief después de cada respuesta, desactivado por defecto

  • CLI speak: echo "hello" | speak

  • Comandos de script de Raycast: Speak lee el texto seleccionado tal como está, Speak Simply lo reescribe con claude -p como un resumen hablado breve primero, Speak Translated lo traduce primero (inglés por defecto; escribe otro idioma como argumento del comando, o establece SPEAK_TRANSLATE_LANGUAGE para cambiar el predeterminado). Una traducción no inglesa se lee con una voz de macOS instalada que coincida, la mejor disponible primero (Premium, luego Enhanced, luego compacta); el inglés deja tu voz normal intacta. Descarga la voz Premium para un idioma en Ajustes del Sistema > Accesibilidad > Leer y hablar > Voz del sistema > Gestionar voces para obtener la buena. Speak Stop detiene. Copian la selección con un Cmd+C simulado, así que Raycast necesita permiso de Accesibilidad.

Related MCP server: MCP Audio Server

Motores

Motor

Coste

Necesita

Notas

say

gratis

macOS

Predeterminado. Descarga una voz Premium o Enhanced en Ajustes del Sistema > Accesibilidad > Contenido hablado para buena calidad. Establece una voz de Siri como predeterminada del sistema y el say simple la usa.

edge

gratis

red

Voces neuronales de Microsoft vía edge-tts-universal. Muy buena calidad. API no oficial.

kokoro

gratis

npm i kokoro-js, ~300MB de modelo en la primera ejecución

TTS neuronal local, funciona en CPU.

openai

de pago

OPENAI_API_KEY

gpt-4o-mini-tts.

elevenlabs

nivel gratuito

ELEVENLABS_API_KEY

eleven_flash_v2_5.

Elegir una voz en macOS

El motor say predeterminado usa la voz del sistema de tu Mac, así que configúrala una vez en macOS y cada lectura la usará:

  1. Abre Ajustes del Sistema > Accesibilidad > Leer y hablar (Contenido hablado en versiones anteriores).

  2. En Voz del sistema, elige una voz. Apple incluye una gran biblioteca por idioma; las Premium y Enhanced se descargan bajo demanda y suenan mucho mejor que las compactas predeterminadas. Las voces de Siri también se pueden elegir aquí.

  3. Ajusta la velocidad de habla a tu gusto.

Pronunciaciones

Dile a Claude en el chat:

  • «pronuncia fancyapp como fan-see-app de ahora en adelante»

  • «qué pronunciaciones has guardado»

Viven en ~/.config/speak/pronunciations.json (anula la carpeta con SPEAK_CONFIG_DIR), se comparan por palabra completa y sin distinguir mayúsculas, y se aplican a cada lectura:

{
  "fancyapp": "fan-see-app",
  "OAuth": "oh auth"
}

Los enlaces y correos se leen hablados: https://example.com/login se convierte en "example punto com barra login", jane@example.de se convierte en "jane arroba example punto d e". Las terminaciones cortas como de, io, co.uk se deletrean letra por letra, ya que "de" leído como palabra suena como "duh".

Las palabras con dos lecturas ("live", "read", "lead") no se pueden corregir con una lista de palabras. La habilidad le dice a Claude que las reescriba en el guion para que la voz no pueda equivocarse: "lyive" para live como en vivo, "red" para read en pasado, "led" para el metal. La habilidad lleva una tabla de los infractores habituales y comprueba el guion contra ella antes de hablar.

Deja SPEAK_VOICE sin establecer para seguir la voz del sistema, o establécelo a un nombre de voz de say -v ? para anular solo para Claude.

El primer motor disponible gana a menos que establezcas SPEAK_ENGINE. SPEAK_VOICE establece la voz. Ambos se pueden cambiar por sesión con la herramienta set_default («cambia al motor edge»).

Instalación

Establece RAYCAST_SCRIPTS_DIR a un directorio ya añadido en Raycast (Ajustes > Extensiones > Comandos de script) y los comandos se enlazan en él. Sin eso, añade raycast/ de este repositorio allí una vez manualmente.

RAYCAST_SCRIPTS_DIR=~/raycast-scripts ./install.sh

Necesita Node 20+, jq y Claude Code.

git clone https://github.com/CareyScott/speak
cd speak
./install.sh

Esto construye el servidor y el ayudante de superposición de macOS (necesita swiftc de las herramientas de línea de comandos de Xcode), registra el servidor MCP a nivel de usuario, enlaza la habilidad en ~/.claude/skills, añade el hook Stop a ~/.claude/settings.json, y enlaza speak y speak-auto en ~/.local/bin.

Reinicia Claude Code.

Uso

Habla con Claude:

  • «léemelo de nuevo»

  • «dilo simplemente»

  • «qué necesitas de mí, en voz alta»

  • «/speak decisions»

  • «para»

Auto-habla después de cada respuesta:

speak-auto on            # brief style
speak-auto on decisions  # only the questions for you
speak-auto off

Mientras habla, usa la superposición o simplemente dilo:

  • «pausa», «reanuda», «retrocede una frase», «salta eso», «para»

Pausa mantiene la posición exacta. Reanudar continúa desde ella. Retroceder reproduce la frase anterior. Saltar avanza a la siguiente. No se dice nada sobre pausar o reanudar; simplemente lo hace.

Elige un motor o voz:

export SPEAK_ENGINE=edge
export SPEAK_VOICE=en-IE-ConnorNeural

O en el chat: «lista las voces de say», «usa Jamie de ahora en adelante».

Cómo funciona

La habilidad le dice a Claude cómo escribir para el oído: frases cortas, ir al grano, describir el código en lugar de leerlo, terminar con la decisión que necesita de ti. Claude llama a la herramienta speak con ese guion.

El servidor elimina cualquier markdown sobrante, divide el guion en frases y sintetiza la siguiente frase mientras se reproduce la actual.

En macOS un pequeño ayudante Swift (overlay/main.swift) controla la reproducción con AVAudioPlayer y dibuja la superposición: un panel siempre encima, no activador, que nunca roba el foco. Node le envía un archivo de frase a la vez por líneas JSON en stdin y él informa finished, back o stop en stdout. Pausa y reanudación ocurren dentro del ayudante, así que la posición es exacta. Retroceder y saltar le dicen al servidor qué frase reproducir a continuación. En otros lugares el servidor recurre a afplay o ffplay sin superposición.

Auto-habla es un hook Stop de Claude Code. Cuando el archivo de marcador ~/.config/speak/auto existe, el hook bloquea la parada una vez y le pide a Claude que hable un guion en el estilo nombrado en el archivo. El guardián stop_hook_active evita que se repita.

Desarrollo

npm run dev        # run the server with tsx
npm test           # vitest
npm run typecheck

MIT.

A
license - permissive license
Not graded
quality - not tested
B
maintenance

Maintenance

Maintainers
Response time
Release cycle
Releases (12mo)
Commit activity

Resources

Unclaimed servers have limited discoverability.

Looking for Admin?

If you are the server author, to access and configure the admin panel.

Related MCP Servers

View all related MCP servers

Related MCP Connectors

  • Generate AI images, video, speech, music and presentations from Claude, ChatGPT and Cursor.

  • Connect Claude to Fathom meeting recordings, transcripts, and summaries

  • Persistent context for Claude. Your AI always knows your projects and next actions across sessions.

View all MCP Connectors

Latest Blog Posts

MCP directory API

We provide all the information about MCP servers via our MCP API.

curl -X GET 'https://glama.ai/api/mcp/v1/servers/CareyScott/speak'

If you have feedback or need assistance with the MCP directory API, please join our Discord server