Voice Mode
VoiceMode
Natürliche Sprachkonversationen mit Claude Code (und anderen MCP-fähigen Agenten)
VoiceMode ermöglicht natürliche Sprachkonversationen mit Claude Code. Bei Sprache geht es nicht darum, das Tippen zu ersetzen – sondern darum, verfügbar zu sein, wenn Tippen nicht möglich ist.
Perfekt für:
Den Weg zum nächsten Meeting
Kochen während des Debuggens
Eine Pause für die Augen nach stundenlanger Bildschirmzeit
Wenn man einen Kaffee (oder einen Hund) hält
Jeden Moment, in dem Ihre Hände oder Augen beschäftigt sind
In Aktion sehen

Related MCP server: Voice Call MCP Server
Schnellstart
Voraussetzungen: Computer mit Mikrofon und Lautsprechern
Option 1: Claude Code Plugin (Empfohlen)
Der schnellste Weg für Claude Code-Benutzer, um loszulegen:
# Add the VoiceMode marketplace
claude plugin marketplace add mbailey/voicemode
# Install VoiceMode plugin
claude plugin install voicemode@voicemode
## Install dependencies (CLI, Local Voice Services)
/voicemode:install
# Start talking!
/voicemode:converseOption 2: Python-Installationspaket
Installiert Abhängigkeiten und das VoiceMode Python-Paket.
# Install UV package manager (if needed)
curl -LsSf https://astral.sh/uv/install.sh | sh
# Run the installer (sets up dependencies and local voice services)
uvx voice-mode-install
# Add to Claude Code
claude mcp add --scope user voicemode -- uvx --refresh voice-mode
# Optional: Add OpenAI API key as fallback for local services
export OPENAI_API_KEY=your-openai-key
# Start a conversation
claude converseFür die manuelle Einrichtung siehe den Getting Started Guide.
Funktionen
Natürliche Konversationen - sprechen Sie natürlich, hören Sie sofort Antworten
Funktioniert offline - optionale lokale Sprachdienste (Whisper STT, Kokoro TTS)
Geringe Latenz - schnell genug, um sich wie ein echtes Gespräch anzufühlen
Intelligente Stilleerkennung - stoppt die Aufnahme, wenn Sie aufhören zu sprechen
Datenschutzoptionen - vollständig lokal ausführen oder Cloud-Dienste nutzen
Kompatibilität
Plattformen: Linux, macOS, Windows (WSL), NixOS Python: 3.10-3.14
Konfiguration
VoiceMode funktioniert sofort nach der Installation. Zur Anpassung:
# Set OpenAI API key (if using cloud services)
export OPENAI_API_KEY="your-key"
# Or configure via file
voicemode config editSiehe den Konfigurationsleitfaden für alle Optionen.
Berechtigungseinrichtung (Optional)
Um VoiceMode ohne Berechtigungsabfragen zu verwenden, fügen Sie dies zu ~/.claude/settings.json hinzu:
{
"permissions": {
"allow": [
"mcp__voicemode__converse",
"mcp__voicemode__service"
]
}
}Siehe den Berechtigungsleitfaden für weitere Optionen.
Lokale Sprachdienste
Für Datenschutz oder Offline-Nutzung installieren Sie lokale Sprachdienste:
Whisper.cpp - Lokale Spracherkennung (Speech-to-Text)
Kokoro - Lokale Sprachsynthese (Text-to-Speech) mit mehreren Stimmen
Diese bieten dieselbe API wie OpenAI, sodass VoiceMode nahtlos zwischen ihnen wechseln kann.
Installationsdetails
Ubuntu/Debian
sudo apt update
sudo apt install -y ffmpeg gcc libasound2-dev libasound2-plugins libportaudio2 portaudio19-dev pulseaudio pulseaudio-utils python3-devWSL2-Benutzer: Die oben genannten pulseaudio-Pakete sind für den Mikrofonzugriff erforderlich.
Fedora/RHEL
sudo dnf install alsa-lib-devel ffmpeg gcc portaudio portaudio-devel python3-develmacOS
brew install ffmpeg node portaudioNixOS
# Use development shell
nix develop github:mbailey/voicemode
# Or install system-wide
nix profile install github:mbailey/voicemodeAus dem Quellcode
git clone https://github.com/mbailey/voicemode.git
cd voicemode
uv tool install -e .NixOS systemweit
# In /etc/nixos/configuration.nix
environment.systemPackages = [
(builtins.getFlake "github:mbailey/voicemode").packages.${pkgs.system}.default
];Fehlerbehebung
Problem | Lösung |
Kein Mikrofonzugriff | Terminal-/App-Berechtigungen prüfen. WSL2 benötigt pulseaudio-Pakete. |
UV nicht gefunden | Führen Sie |
OpenAI API-Fehler | Überprüfen Sie, ob |
Keine Audioausgabe | System-Audioeinstellungen und verfügbare Geräte prüfen |
Audio für Debugging speichern
export VOICEMODE_SAVE_AUDIO=true
# Files saved to ~/.voicemode/audio/YYYY/MM/Dokumentation
Erste Schritte - Vollständige Einrichtungsanleitung
Konfiguration - Alle Umgebungsvariablen
Whisper-Einrichtung - Lokale Spracherkennung
Kokoro-Einrichtung - Lokale Sprachsynthese
Entwicklungseinrichtung - Leitfaden für Mitwirkende
Vollständige Dokumentation: voice-mode.readthedocs.io
Links
Website: getvoicemode.com
GitHub: github.com/mbailey/voicemode
YouTube: @getvoicemode
Twitter/X: @getvoicemode
Newsletter:
Lizenz
MIT - Ein Failmode Projekt
mcp-name: com.failmode/voicemode
This server cannot be deployed
Maintenance
Related MCP Connectors
A comprehensive Model Context Protocol (MCP) server that enables AI assistants to interact with yo…
- QuallaaOAuthcom.quallaa
Talk to your public-facing AI from any MCP client — Claude, ChatGPT, Cursor, Cline, Windsurf.
AI voice generation: text-to-speech and voice cloning from any MCP client.
Build and manage AI-native customer support agents from Claude or any MCP client.
Related MCP Servers
- AlicenseNot gradedqualityCmaintenanceA Model Context Protocol server that integrates high-quality text-to-speech capabilities with Claude Desktop and other MCP-compatible clients, supporting multiple voice options and audio formats.17 npm1MIT
- AlicenseNot gradedqualityDmaintenanceA Model Context Protocol server that enables AI assistants like Claude to initiate and manage real-time voice calls using Twilio and OpenAI's voice models.62MIT
- AlicenseBqualityDmaintenanceAn MCP (Model Context Protocol) server that provides seamless integration between Fish Audio's Text-to-Speech API and LLMs like Claude, enabling natural language-driven speech synthesis.2171 npm14MIT
- FlicenseNot gradedqualityNot gradedmaintenanceA local voice interface providing high-performance speech recognition and natural text-to-speech with voice cloning capabilities. It enables AI assistants to speak, listen, and engage in character-based voice conversations through integrated MCP tools.-