Skip to main content
Glama

VoiceMode

Естественные голосовые диалоги с Claude Code (и другими агентами, поддерживающими MCP)

PyPI Downloads PyPI Downloads PyPI Downloads

VoiceMode позволяет вести естественные голосовые диалоги с Claude Code. Голос — это не замена печати, а способ взаимодействия, когда печатать неудобно.

Идеально подходит для:

  • Прогулки на следующую встречу

  • Приготовления еды во время отладки кода

  • Отдыха для глаз после долгих часов работы за экраном

  • Ситуаций, когда вы держите чашку кофе (или собаку)

  • Любого момента, когда ваши руки или глаза заняты

Демонстрация

VoiceMode Demo

Related MCP server: Voice Call MCP Server

Быстрый старт

Требования: Компьютер с микрофоном и динамиками

Вариант 1: Плагин Claude Code (рекомендуется)

Самый быстрый способ начать работу для пользователей Claude Code:

# Add the VoiceMode marketplace
claude plugin marketplace add mbailey/voicemode

# Install VoiceMode plugin
claude plugin install voicemode@voicemode

## Install dependencies (CLI, Local Voice Services)

/voicemode:install

# Start talking!
/voicemode:converse

Вариант 2: Установщик Python

Устанавливает зависимости и пакет VoiceMode для Python.

# Install UV package manager (if needed)
curl -LsSf https://astral.sh/uv/install.sh | sh

# Run the installer (sets up dependencies and local voice services)
uvx voice-mode-install

# Add to Claude Code
claude mcp add --scope user voicemode -- uvx --refresh voice-mode

# Optional: Add OpenAI API key as fallback for local services
export OPENAI_API_KEY=your-openai-key

# Start a conversation
claude converse

Для ручной настройки см. Руководство по началу работы.

Возможности

  • Естественные диалоги — говорите как обычно, получайте ответы мгновенно

  • Работа офлайн — опциональные локальные голосовые сервисы (Whisper STT, Kokoro TTS)

  • Низкая задержка — достаточно быстро, чтобы ощущалось как живой разговор

  • Умное определение тишины — прекращает запись, когда вы перестаете говорить

  • Настройки конфиденциальности — работайте полностью локально или используйте облачные сервисы

Совместимость

Платформы: Linux, macOS, Windows (WSL), NixOS Python: 3.10-3.14

Конфигурация

VoiceMode работает сразу после установки. Для настройки:

# Set OpenAI API key (if using cloud services)
export OPENAI_API_KEY="your-key"

# Or configure via file
voicemode config edit

См. Руководство по конфигурации для просмотра всех параметров.

Настройка разрешений (опционально)

Чтобы использовать VoiceMode без запросов на разрешение, добавьте в ~/.claude/settings.json:

{
  "permissions": {
    "allow": [
      "mcp__voicemode__converse",
      "mcp__voicemode__service"
    ]
  }
}

См. Руководство по разрешениям для получения дополнительной информации.

Локальные голосовые сервисы

Для обеспечения конфиденциальности или работы офлайн установите локальные речевые сервисы:

  • Whisper.cpp — локальное распознавание речи (STT)

  • Kokoro — локальный синтез речи (TTS) с поддержкой нескольких голосов

Они предоставляют тот же API, что и OpenAI, поэтому VoiceMode легко переключается между ними.

Детали установки

Ubuntu/Debian

sudo apt update
sudo apt install -y ffmpeg gcc libasound2-dev libasound2-plugins libportaudio2 portaudio19-dev pulseaudio pulseaudio-utils python3-dev

Пользователи WSL2: пакеты pulseaudio выше необходимы для доступа к микрофону.

Fedora/RHEL

sudo dnf install alsa-lib-devel ffmpeg gcc portaudio portaudio-devel python3-devel

macOS

brew install ffmpeg node portaudio

NixOS

# Use development shell
nix develop github:mbailey/voicemode

# Or install system-wide
nix profile install github:mbailey/voicemode

Из исходного кода

git clone https://github.com/mbailey/voicemode.git
cd voicemode
uv tool install -e .

Системная установка в NixOS

# In /etc/nixos/configuration.nix
environment.systemPackages = [
  (builtins.getFlake "github:mbailey/voicemode").packages.${pkgs.system}.default
];

Устранение неполадок

Проблема

Решение

Нет доступа к микрофону

Проверьте разрешения терминала/приложения. WSL2 требует пакеты pulseaudio.

UV не найден

Запустите curl -LsSf https://astral.sh/uv/install.sh | sh

Ошибка OpenAI API

Убедитесь, что OPENAI_API_KEY задан верно

Нет вывода звука

Проверьте системные настройки звука и доступные устройства

Сохранение аудио для отладки

export VOICEMODE_SAVE_AUDIO=true
# Files saved to ~/.voicemode/audio/YYYY/MM/

Документация

Полная документация: voice-mode.readthedocs.io

Ссылки

Лицензия

MIT — проект Failmode


mcp-name: com.failmode/voicemode

Related MCP Connectors

Related MCP Servers

  • A
    license
    Not graded
    quality
    C
    maintenance
    A Model Context Protocol server that integrates high-quality text-to-speech capabilities with Claude Desktop and other MCP-compatible clients, supporting multiple voice options and audio formats.
    17 npm
    1
    MIT
  • A
    license
    B
    quality
    D
    maintenance
    An MCP (Model Context Protocol) server that provides seamless integration between Fish Audio's Text-to-Speech API and LLMs like Claude, enabling natural language-driven speech synthesis.
    2
    171 npm
    14
    MIT
  • F
    license
    Not graded
    quality
    Not graded
    maintenance
    A local voice interface providing high-performance speech recognition and natural text-to-speech with voice cloning capabilities. It enables AI assistants to speak, listen, and engage in character-based voice conversations through integrated MCP tools.
    -