yzfly/douyin-mcp-server · 上手攻略
- 仓库:yzfly/douyin-mcp-server
- 链接:https://github.com/yzfly/douyin-mcp-server
- 分类:academic-writing
- 作者:Jay
- 更新:2026-08-22
这是什么
douyin-mcp-server 是一个开源的抖音/字节系短视频数据提取工具,提供无水印视频下载链接获取、AI 语音识别提取视频文案两项核心功能。它同时提供 WebUI(浏览器界面)、MCP Server(AI 助手集成)、命令行三种使用方式,支持 Claude Desktop、 Cherry Studio 等支持 MCP 协议的应用。
核心语音识别使用硅基流动的 SenseVoice(FunAudioLLM/SenseVoiceSmall)模型。
解决什么问题
短视频内容创作者、学术研究者、媒体分析人员经常需要:提取抖音视频的无水印下载链接(用于存档或二次创作)、以及将视频语音内容转成文字文案(用于内容分析、字幕生成、研究素材整理)。douyin-mcp-server 将这两个需求合二为一,并封装为 AI Agent 可直接调用的 MCP 工具。
快速安装
依赖前提
| 依赖 | 说明 | 安装命令 |
|---|---|---|
| uv | Python 包管理器 | curl -LsSf https://astral.sh/uv/install.sh \| sh |
| Python | 3.10+ | uv python install 3.12 |
| FFmpeg | 音视频处理 | macOS: brew install ffmpeg;Ubuntu: apt install ffmpeg |
克隆安装
git clone https://github.com/yzfly/douyin-mcp-server.git
cd douyin-mcp-server
uv sync
获取 API Key(必需)
语音识别需要 API Key,有两种免费/低价方案:
- 硅基流动(推荐):注册链接,新用户有免费额度;模型为 FunAudioLLM/SenseVoiceSmall
- 阿里云百炼(旧版兼容):设置
DASHSCOPE_API_KEY同样可用
⚠️ 获取视频信息/下载链接不需要 API Key;提取文案才需要。
核心用法
方式一:WebUI(普通用户推荐)
# 方式 A:浏览器内配置 API Key(推荐)
uv run python web/app.py
# 打开 http://localhost:8080,在页面顶部点击「API 未配置」输入 Key
# 方式 B:环境变量配置
export API_KEY="sk-xxxxxxxxxxxxxxxx"
uv run python web/app.py
# 打开 http://localhost:8080
WebUI 操作流程: 1. 将抖音分享链接粘贴到输入框 2. 点击「获取信息」(无需 API,显示视频标题、ID、下载链接) 3. 点击「提取文案」(需要 API,自动下载→转音频→AI 识别→输出 Markdown)
方式二:MCP Server(Claude Desktop 等 AI 应用)
编辑 MCP 配置文件(路径因系统而异):
{
"mcpServers": {
"douyin-mcp": {
"command": "uvx",
"args": ["douyin-mcp-server"],
"env": {
"API_KEY": "sk-xxxxxxxxxxxxxxxx"
}
}
}
}
配置后可在 Claude 对话中直接调用:
用户:帮我提取这个视频的文案 https://v.douyin.com/xxxxx/
Claude:[调用 extract_douyin_text 工具] → 提取完成,文案内容如下...
可用 MCP 工具一览:
| 工具名 | 功能 | 需要 API |
|---|---|---|
parse_douyin_video_info |
解析视频信息(标题、ID等) | ❌ |
get_douyin_download_link |
获取无水印下载链接 | ❌ |
extract_douyin_text |
提取视频文案(下载+识别) | ✅ |
recognize_audio_file |
识别本地音频文件 | ✅(百炼) |
recognize_audio_url |
识别在线音频链接 | ✅(百炼) |
方式三:命令行(开发者/批量处理)
# 查看帮助
uv run python douyin-video/scripts/douyin_downloader.py --help
# 获取视频信息(无需 API)
uv run python douyin-video/scripts/douyin_downloader.py \
-l "分享链接" -a info
# 下载无水印视频
uv run python douyin-video/scripts/douyin_downloader.py \
-l "分享链接" -a download -o ./videos
# 提取文案
export API_KEY="sk-xxx"
uv run python douyin-video/scripts/douyin_downloader.py \
-l "分享链接" -a extract -o ./output
# 提取文案并保存视频
uv run python douyin-video/scripts/douyin_downloader.py \
-l "分享链接" -a extract -o ./output --save_video
输出格式
output/
└── {video_id}/
├── transcript.md # 文案文件(Markdown 格式)
└── *.mp4 # 视频文件(可选)
transcript.md 示例结构:
# 视频标题
| 属性 | 值 |
|------|-----|
| 视频ID | `7600361826030865707` |
| 提取时间 | 2026-01-30 14:19:00 |
| 下载链接 | [点击下载](url) |
---
## 文案内容
这里是 AI 识别的语音文案...
大文件自动分段
当音频超过 1 小时或 50MB 时,工具自动: 1. 用 FFmpeg 切分为 9 分钟片段 2. 逐段调用 SenseVoice API 转录 3. 合并所有文本结果
典型适用场景
- 内容创作者素材收集:批量提取同领域竞品视频文案,做竞品分析和选题参考
- 学术研究:提取短视频的口语语料,用于语言学研究或内容分析(如舆情分析、社媒研究)
- 字幕/文案整理:将口播视频转文字,用于再创作或存档
- AI 训练数据收集:构建短视频语音数据集
- 媒体监测:监测特定话题下的视频内容,无需手动观看
坑与注意
- API Key 区分:硅基流动 API Key 和阿里云百炼 Key 是两套;新版用硅基流动(
API_KEY),旧版用百炼(DASHSCOPE_API_KEY),二者设一即可。最新文档已更新,建议优先使用硅基流动。 - FFmpeg 必需:音频提取依赖 FFmpeg,未安装会报错;Windows 用户可从 ffmpeg.org 下载。
- 分享链接格式:抖音分享链接通常形如
https://v.douyin.com/xxxxx/,需要是有效链接,失效或已删视频无法处理。 - 下载接口安全:新版本(WebUI 安全加固后)下载接口不再代理任意 URL,默认仅监听本机,防止被滥用。
- 仅供学习研究:项目 README 明确声明「仅供学习和研究使用」,请遵守相关法律法规,禁止用于侵犯知识产权的行为。
- API 限额:硅基流动新用户有免费额度,但有 QPS/日限额;大批量提取需要注意频率控制。
- 长音频处理:超过 1 小时/50MB 的视频会自动分段,但每段仍需调用 API,注意用量。
与同类对比
| douyin-mcp-server | 各类在线解析网站 | yt-dlp | |
|---|---|---|---|
| 无水印下载 | ✅ | ✅ | ✅ |
| AI 文案提取 | ✅ | ❌ | ❌ |
| MCP 协议 | ✅ | ❌ | ❌ |
| Claude Desktop 集成 | ✅ | ❌ | ❌ |
| 本地运行/离线 | ✅ | ❌ | ✅ |
| 大文件自动分段 | ✅ | ❌ | ❌ |
| WebUI | ✅ | ✅ | ❌ |
| 维护状态 | 活跃更新 | 不稳定(网站常关闭) | 非常活跃 |
相比在线解析网站,douyin-mcp-server 提供 AI 语音识别 + 可编程接口;相比通用下载工具 yt-dlp,它专门针对抖音生态优化且自带 ASR 文案提取能力。
一句话推荐结论
需要在 AI 工作流中批量提取抖音视频文案(非手动下载+转写),或希望用自然语言让 Claude 帮你分析短视频内容的,douyin-mcp-server 是目前最顺滑的开源方案;单纯下载视频推荐用 yt-dlp。