获取 YouTube 视频转录
get_video_transcriptConvert any YouTube video into a timestamped Markdown transcript, first trying existing subtitles and falling back to Whisper if none exist. Metadata + preview returned; full transcript saved to file.
Instructions
把 YouTube 视频转成文字稿:优先拉取现成字幕(人工 > 自动),秒级完成、不占 CPU;只有在没有合适字幕时才回退到本地 faster-whisper 从音频转录。结果落盘成 Obsidian 友好的 Markdown(frontmatter + 带时间戳章节),并缓存供重复调用秒级命中。 转录质量:Whisper 的模型档位可调。默认 large-v3-turbo 更准;要快速草稿可传 model="small"(快约 1.8 倍,但会听错常用词、甚至整段丢失)。换模型会自动让该视频的缓存失效,所以「先用 small 试、再用大模型重跑」不会重复下载。 注意:正文在 savedTo 指向的文件里,本工具只返回元数据 + 预览 + 供下一步使用的提示,不要期待它返回全文。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| url | Yes | YouTube 视频链接或 11 位 video id | |
| force | No | 忽略缓存,强制重新转录 | |
| model | No | Whisper 模型,不填用 YTS_MODEL(默认 large-v3-turbo)。small 约 0.36x 实时但中文质量明显更差;large-v3 更慢却不比 turbo 准。 | |
| hotwords | No | 额外的领域词表(人名/术语),空格分隔、**用简体**。默认已从视频标题自动抽词,这里只补自动抽不到的名字;换词会作废缓存。 | |
| preview_length | No | 返回的预览长度:short≈1200字 / medium≈4000字 / long≈12000字。完整转录始终在落盘文件里。 | medium |
| output_language | No | 后续总结/整理用什么语言,默认 auto(跟视频原声一致)。只影响 summaryHint,不改转录本身。 |