transcribe_audio
Convert audio files to text with automatic chunking for long recordings. Supports mp3, wav, m4a, flac, ogg, webm.
Instructions
Transcribe an audio file to text using AutoGLM ASR.
Supports: mp3, wav, m4a, flac, ogg, webm
Features:
Automatic chunking for long audio (>30s)
Sliding window concurrency for speed + quality
Context passing between chunks for better accuracy
Args: audio_path: Absolute path to the audio file context_mode: "sliding" (recommended), "none" (fastest), or "full_serial" (best quality but slow) max_concurrency: Max parallel API requests (default: 5)
Returns: Full transcription text with timing segments
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| audio_path | Yes | Absolute path to the audio file to transcribe | |
| context_mode | No | Context strategy: 'sliding' (balanced), 'none' (fastest), 'full_serial' (best quality) | sliding |
| max_concurrency | No | Maximum number of concurrent API requests |