describe_video_url
Describe video content from direct video URLs or YouTube links with Gemini AI, returning timestamped descriptions and supporting custom prompts.
Instructions
从【网络直链】下载、或从【YouTube 视频页】云端直读视频再交给 Gemini 识别,返回按时间轴分段的中文描述。
两种输入都支持:
视频文件直链(以 .mp4/.mov/.webm 等结尾、点开就是视频本体):下载到服务器 temp_media/ 临时目录, 识别完就删掉。
✅ YouTube 视频页链接(youtube.com/watch、youtu.be 短链、shorts 等)可以直接传,服务器不下载、 由 Gemini 云端直读;仅支持公开视频(私享/会员/年龄限制的不行),免费层每天有 YouTube 总时长限额, 长视频照常按秒计费。
⚠️ B站/抖音/TikTok 等其他平台页面仍不支持(那需要 yt-dlp 之类工具,本服务器暂不支持)。 若给的是这类平台页面链接、或链接打开是网页而非视频文件,会明确报错。
其余参数(prompt/persona/hint/low_resolution/max_output_tokens)含义与 describe_video 完全一致。
Args: url: 视频文件的 http/https 直链,或 YouTube 视频页链接(youtube.com/watch、youtu.be、shorts)。 prompt: 自定义提示词,传了就完全覆盖默认模板(此时 persona/hint 被忽略)。 persona: 可选人设,仅在未传 prompt 时生效。 hint: 可选前置线索,仅在未传 prompt 时生效。 low_resolution: 低清省钱开关,默认关闭。 max_output_tokens: 最大输出 token,默认 30000(内部有 2048 下限保护)。
Returns: Gemini 生成的视频描述文本(末尾可能带用量统计或截断提示)。
Input Schema
| Name | Required | Description | Default |
|---|---|---|---|
| url | Yes | ||
| hint | No | ||
| prompt | No | ||
| persona | No | ||
| low_resolution | No | ||
| max_output_tokens | No |