clova-speech-lecture-mcp
MCP-сервер CLOVA Speech Lecture
MCP-сервер для STT (преобразования речи в текст) и суммаризации записей лекций.
Вызывает API Naver CLOVA Speech / CLOVA Studio из агента Google ADK.
Предоставляемые инструменты
Название инструмента | Описание | Подходящие сценарии |
| Синхронный STT (до 60 секунд) | Короткие клипы, тестирование |
| Отправка асинхронного STT (вся лекция) | Лекции от десятков минут до нескольких часов |
| Получение результата асинхронного STT | Опрос после отправки (submit) |
| Суммаризация транскрипта лекции | После завершения транскрибации |
Related MCP server: audio-transcriber
Начало работы
1. Получение API-ключей
CLOVA Speech (STT)
Войдите в Naver Cloud Platform
AI Services → CLOVA Speech → Заявка на использование
После создания сервиса скопируйте Secret Key
CLOVA Studio (Суммаризация)
AI Services → CLOVA Studio → Заявка на использование
Создайте приложение в Playground
Скопируйте API-ключ и ID приложения
2. Настройка .env
cp .env .env.local # 실제 값으로 수정CLOVA_SPEECH_API_KEY=실제_키_입력
CLOVA_STUDIO_CLIENT_ID=실제_Client_ID
CLOVA_STUDIO_CLIENT_SECRET=실제_Client_Secret
CLOVA_STUDIO_APP_ID=실제_앱_ID3. Запуск
# Docker
docker-compose up -d
# 로컬 실행
pip install -r requirements.txt
python app/main.py4. Подключение агента ADK
# agent.py 예시
tools = [
MCPToolset(
connection_params=SseServerParams(url="http://localhost:8002/sse")
)
]Процесс обработки лекций
[강의 오디오 파일]
↓
transcribe_lecture_submit(file_path, enable_diarization=True)
↓ (task_id 반환)
get_transcription_result(task_id) ← 완료까지 자동 폴링
↓ (full_text 반환)
summarize_lecture(text)
↓
[요약문 + 키워드]Поддерживаемые форматы аудио
.wav .mp3 .flac .m4a .aac .ogg
Поддерживаемые языки
Код (короткий) | Код (длинный) | Язык |
|
| Корейский |
|
| Английский |
|
| Японский |
This server cannot be deployed
Maintenance
Related MCP Connectors
Pronunciation assessment, phoneme scoring, speaker voice ID, audio transcription, speech synthesis.
Pronunciation scoring, speech-to-text, and text-to-speech for language learning
- mcpOAuthso.transcribe
Transcribe audio and video into speaker-labelled transcripts, subtitles, clips, and cited Q&A.
AI transcription from URLs or files. 119 languages, diarization, SRT/VTT/text export.
Related MCP Servers
- AlicenseAqualityDmaintenanceProvides accurate meeting transcription with speaker diarization and multilingual support, allowing users to submit audio URLs, poll transcription status, get transcripts, and summarize via MCP tools in their IDE.81MIT
- AlicenseNot gradedqualityAmaintenanceMCP server that enables audio transcription from files (wav, mp4, mp3, flac) or microphone recording, with dynamic tool selection and enterprise-grade security.3MIT
- AlicenseNot gradedqualityBmaintenanceMCP server for GovTech's Transcribe speech-to-text service, enabling audio upload, batch transcription, summaries, minutes, sections, notes, and transcript Q&A.GPL 3.0
- AlicenseNot gradedqualityCmaintenanceMCP server that converts videos, audio, and meeting recordings into structured transcripts and summaries with multi-backend ASR and automatic fallback.MIT