start_transcription
Starts real-time transcription of system audio, capturing audio in chunks and converting speech to text continuously via OpenAI Whisper.
Instructions
Start capturing and transcribing system audio in real-time using OpenAI Whisper. Audio is captured in chunks and transcribed continuously. IMPORTANT: After starting, periodically check get_status (every 30-60 seconds) to monitor for issues. SAFETY FEATURES: The system will auto-pause in two scenarios: 1) After 32 seconds of silence, 2) After 30 minutes of NO user interaction (prevents forgotten recordings). User interaction = calling get_status, pause_transcription, resume_transcription, get_transcript, or clear_transcript. When paused, you'll see isPaused: true in status. User must explicitly call resume_transcription to continue.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| outputFile | No | Output transcript filename (default: auto-generated timestamped filename for privacy/isolation) | |
| inputDevice | No | Audio input device name (default: BlackHole) | |
| chunkSeconds | No | Seconds of audio per transcription chunk (default: 8) |