douyin-mcp-server
抖音链接转写与口播整理
从抖音分享链接自动解析媒体,本机生成逐字稿,再整理成可用口播文案。

本项目基于 yzfly/douyin-mcp-server 继续维护;保留原项目的 Apache-2.0 许可。
✨ 功能特性
🎬 无水印视频 - 获取高质量无水印视频下载链接
🛟 自动降级 - HTTP 解析失败时使用共享 Playwright 捕获签名音频
🎙️ 本地语音识别 -
faster-whisper-medium / CPU int8,不消耗 ASR API✍️ 口播整理 - DeepSeek 去重复、补标点和结构,保留原意
🌐 WebUI - 现代化浏览器界面,无需命令行
🔌 MCP 集成 - 支持 Claude Desktop 等 AI 应用
Related MCP server: Douyin Video Analysis MCP
项目结构
assets/ 预览图和发布用 skill 包
douyin_mcp_server/ Python 核心包
scripts/ 命令行入口
skills/douyin-video/ 可复用的工作流说明
tests/ 单元测试
web/ FastAPI WebUI📦 使用方式
方式 | 适用场景 | 特点 |
普通用户 | 浏览器操作,最简单 | |
Claude Desktop 用户 | AI 对话中直接调用 | |
开发者 | 批量处理,脚本集成 |
🌐 WebUI (推荐)
最简单的使用方式,打开浏览器即可使用。
快速开始
# 1. 克隆你自己的仓库
git clone <your-repository-url>
cd douyin-mcp-server
# 2. 安装依赖
uv sync --extra web
# 3. 启动服务
uv run python web/app.py打开浏览器访问 http://localhost:8080
配置 DeepSeek API Key
有两种方式配置 API Key:
方式一:浏览器内配置
打开 WebUI 页面
点击顶部的「API 未配置」按钮
在弹窗中输入 API Key 并保存
API Key 保存在浏览器本地,仅随提取请求发送给本机服务
方式二:环境变量
export DOUYIN_DEEPSEEK_API_KEY="<your-deepseek-api-key>"
uv run python web/app.py本地 ASR 不需要密钥;DeepSeek Key 只用于最后一步口播整理。
功能说明
操作 | 说明 | 需要 API |
获取信息 | 解析视频标题、ID,获取无水印下载链接 | ❌ |
提取文案 | HTTP/Playwright → 音频 → 本地 ASR → DeepSeek | ✅(仅整理) |
下载视频 | 点击下载链接保存无水印视频 | ❌ |
复制/下载文案 | 一键复制或下载 Markdown 格式文案 | - |
使用步骤
粘贴链接 - 将分享链接粘贴到输入框
点击按钮 - 选择「获取信息」或「提取文案」
查看结果 - 右侧显示视频信息和提取的文案
导出 - 复制文案或下载 Markdown 文件
🚀 MCP Server
在 Claude Desktop、Cherry Studio 等支持 MCP 的应用中使用。
配置方法
编辑 MCP 配置文件,添加:
{
"mcpServers": {
"douyin-mcp": {
"command": "uvx",
"args": ["douyin-mcp-server"],
"env": {
"DOUYIN_DEEPSEEK_API_KEY": "<your-deepseek-api-key>"
}
}
}
}DOUYIN_DEEPSEEK_API_KEY 只放运行环境,不写入仓库、输出文件或运行报告。
可用工具
工具名 | 功能 | 需要 API |
| 解析视频信息 | ❌ |
| 获取下载链接 | ❌ |
| 自动降级、本地转写并整理口播 | ✅(仅整理) |
| 本机 faster-whisper 识别音频 | ❌ |
| 识别在线音频链接 | ✅ (百炼) |
对话示例
用户:帮我提取这个视频的文案 https://v.douyin.com/xxxxx/
Claude:我来帮你提取视频文案...
[调用 extract_douyin_text 工具]
提取完成,文案内容如下:
...🛠️ 命令行工具
适合开发者和批量处理场景。
安装
git clone https://github.com/yzfly/douyin-mcp-server.git
cd douyin-mcp-server
uv sync命令说明
# 查看帮助
uv run python scripts/douyin_downloader.py --help
# 获取视频信息(无需 API)
uv run python scripts/douyin_downloader.py -l "分享链接" -a info
# 下载无水印视频
uv run python scripts/douyin_downloader.py -l "分享链接" -a download -o ./videos
# 提取文案(本地 ASR;整理阶段需要 DOUYIN_DEEPSEEK_API_KEY)
export DOUYIN_DEEPSEEK_API_KEY="<your-deepseek-api-key>"
uv run python scripts/douyin_downloader.py -l "分享链接" -a extract -o ./output
输出格式
output/
└── 7600361826030865707/
├── audio.m4a # 已校验的完整音频
├── transcript-raw.md # 本地 ASR 原始逐字稿
├── copy.md # DeepSeek 整理后的口播
├── metadata.json
└── run-report.json # 五阶段状态和验证证据📋 系统要求
依赖 | 说明 | 安装方式 |
uv | Python 包管理 |
|
Python | 3.10–3.13(推荐 3.12) |
|
FFmpeg | 音视频处理 |
|
faster-whisper medium | 本地 ASR 权重 | 默认读取 |
Playwright | HTTP 解析失败后的浏览器降级 | Windows 使用 |
🔧 技术说明
固定工作流
HTTP 解析分享链接;失败时自动降级到 Playwright。
HTTP 分支下载视频;浏览器分支按 Range 下载签名音频。
HTTP 分支用 FFmpeg 抽音;浏览器分支用 ffprobe 校验完整音频。
本机
faster-whisper-medium / CPU int8生成带时间戳逐字稿。DeepSeek 整理成口播文案,并写入
run-report.json。
📝 更新日志
v1.5.0(当前工作站版)
HTTP 解析失败自动降级到共享 Playwright
使用本机
faster-whisper-medium / CPU int8,ASR 不再依赖云端 API使用 DeepSeek V4 Flash 整理口播文案
固定输出音频、原始逐字稿、整理文案、元数据和运行报告
v1.4.1
🔧 MCP Server 修复 -
API_KEY现在正确对应硅基流动密钥,与文档一致;同时兼容旧版DASHSCOPE_API_KEY配置♻️ 恢复工具 - 恢复
recognize_audio_file/recognize_audio_url工具及extract_douyin_text的context参数🛡️ WebUI 安全加固 - 下载接口不再代理任意 URL,默认仅监听本机
⚡ WebUI 性能 - 提取文案不再阻塞其他请求
📦 依赖精简 - WebUI 依赖改为可选安装(
pip install "douyin-mcp-server[web]")
v1.4.0
🌐 WebUI - 新增浏览器可视化界面
🔑 浏览器配置 API Key - 无需环境变量
📑 大文件支持 - 自动分段处理长音频
v1.3.0
✨ Claude Code Skill 支持
📄 Markdown 格式输出
v1.2.0
🔄 API 升级
v1.0.0
🎉 首次发布
⚠️ 免责声明
本项目仅供学习和研究使用
使用者需遵守相关法律法规
禁止用于侵犯知识产权的行为
作者不对使用本项目产生的损失承担责任
📄 许可证
Apache License 2.0
🤝 贡献
提交 Issue 或 Pull Request 前,请阅读 CONTRIBUTING.md。安全问题请按 SECURITY.md 的方式私下报告。
准备发布到自己的 GitHub 仓库前,请把 pyproject.toml 中的 project.urls 补成你的仓库地址,并按需要修改项目名称和作者信息。
上游来源
原始项目作者:yzfly(GitHub)。
This server cannot be installed
Maintenance
Resources
Unclaimed servers have limited discoverability.
Looking for Admin?
If you are the server author, to access and configure the admin panel.
Related MCP Servers
- AlicenseNot gradedqualityFmaintenanceAn MCP server that downloads videos/extracts audio from various platforms like YouTube, Bilibili, and TikTok, then transcribes them to text using OpenAI's Whisper model.11MIT
- AlicenseAqualityCmaintenanceAn MCP server that parses Douyin share links and performs intelligent content analysis using the Doubao video understanding model. It provides structured outputs including video summaries, categorized outlines, and step-by-step tutorial information.12MIT
- AlicenseNot gradedqualityDmaintenanceA Model Context Protocol server that downloads watermark-free videos from Douyin (TikTok China) share links, extracts audio, and transcribes speech to text using ASR APIs.2MIT
- AlicenseNot gradedqualityCmaintenanceMCP server for fetching YouTube video transcripts without an API key.GPL 3.0
Related MCP Connectors
MCP server for ByteDance Seedance AI video generation
MCP server for Kling AI video generation
MCP server for Hailuo (MiniMax) AI video generation
Latest Blog Posts
- Who's Calling? MCP Hosts Are an Identity Blind Spot (And the Spec Knows It)By Om-Shree-0709 on .mcpAgent IdentityOAuth 2.1
- Your AI Chatbot Just Exposed Your CEO's Salary to an InternBy Om-Shree-0709 on .Agent IdentityMCP SecurityOAuth Delegation
- Why MCP Servers Need Execution Sandboxing (And Why Your Current Stack Isn't Enough)By Om-Shree-0709 on .Agentic AiPrompt InjectionWebAssembly
MCP directory API
We provide all the information about MCP servers via our MCP API.
curl -X GET 'https://glama.ai/api/mcp/v1/servers/dvdxfv/douyin-mcp-server'
If you have feedback or need assistance with the MCP directory API, please join our Discord server