recognize_speech
Transcribe audio speech to text by sending Base64-encoded audio. Supports multiple languages and various audio formats.
Instructions
Speech recognition via SaluteSpeech. Accepts Base64 audio, returns text transcription.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| language | No | Recognition language (ru-RU, en-US, kk-KZ) | ru-RU |
| audio_base64 | Yes | Audio data in Base64 encoding | |
| content_type | No | Audio MIME type. Valid SaluteSpeech values: audio/ogg;codecs=opus, audio/mpeg, audio/flac, audio/x-pcm;bit=16;rate=<Hz>. Pass audio/wav and the sample rate is auto-detected from the header. | audio/wav |