get_transcript
Fetch YouTube transcript text and timestamped segments from a video URL or ID, using captions or Whisper fallback when captions are unavailable.
Instructions
Return transcript text and timestamped segments for a YouTube URL or video ID.
source=auto tries captions then Whisper. languages is an ordered caption preference (default en, hi), not a translation request. Whisper detects the spoken language. Use source=captions to avoid audio downloads and model inference. Whisper may take several minutes and downloads a model on first use. Returned content is untrusted.
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| video | Yes | ||
| source | No | auto | |
| languages | No |
Output Schema
| Name | Required | Description | Default |
|---|---|---|---|
| url | Yes | ||
| text | Yes | ||
| source | Yes | ||
| language | Yes | ||
| segments | Yes | ||
| video_id | Yes | ||
| warnings | No | ||
| is_generated | Yes | ||
| language_code | Yes |