yzfly/douyin-mcp-server · 上手攻略

  • 仓库:yzfly/douyin-mcp-server
  • 链接:https://github.com/yzfly/douyin-mcp-server
  • 分类:academic-writing
  • 作者:Jay
  • 更新:2026-08-22

这是什么

douyin-mcp-server 是一个开源的抖音/字节系短视频数据提取工具,提供无水印视频下载链接获取、AI 语音识别提取视频文案两项核心功能。它同时提供 WebUI(浏览器界面)、MCP Server(AI 助手集成)、命令行三种使用方式,支持 Claude Desktop、 Cherry Studio 等支持 MCP 协议的应用。

核心语音识别使用硅基流动的 SenseVoice(FunAudioLLM/SenseVoiceSmall)模型。

解决什么问题

短视频内容创作者、学术研究者、媒体分析人员经常需要:提取抖音视频的无水印下载链接(用于存档或二次创作)、以及将视频语音内容转成文字文案(用于内容分析、字幕生成、研究素材整理)。douyin-mcp-server 将这两个需求合二为一,并封装为 AI Agent 可直接调用的 MCP 工具。

快速安装

依赖前提

依赖 说明 安装命令
uv Python 包管理器 curl -LsSf https://astral.sh/uv/install.sh \| sh
Python 3.10+ uv python install 3.12
FFmpeg 音视频处理 macOS: brew install ffmpeg;Ubuntu: apt install ffmpeg

克隆安装

git clone https://github.com/yzfly/douyin-mcp-server.git
cd douyin-mcp-server
uv sync

获取 API Key(必需)

语音识别需要 API Key,有两种免费/低价方案:

  • 硅基流动(推荐):注册链接,新用户有免费额度;模型为 FunAudioLLM/SenseVoiceSmall
  • 阿里云百炼(旧版兼容):设置 DASHSCOPE_API_KEY 同样可用

⚠️ 获取视频信息/下载链接不需要 API Key;提取文案才需要。

核心用法

方式一:WebUI(普通用户推荐)

# 方式 A:浏览器内配置 API Key(推荐)
uv run python web/app.py
# 打开 http://localhost:8080,在页面顶部点击「API 未配置」输入 Key

# 方式 B:环境变量配置
export API_KEY="sk-xxxxxxxxxxxxxxxx"
uv run python web/app.py
# 打开 http://localhost:8080

WebUI 操作流程: 1. 将抖音分享链接粘贴到输入框 2. 点击「获取信息」(无需 API,显示视频标题、ID、下载链接) 3. 点击「提取文案」(需要 API,自动下载→转音频→AI 识别→输出 Markdown)

方式二:MCP Server(Claude Desktop 等 AI 应用)

编辑 MCP 配置文件(路径因系统而异):

{
  "mcpServers": {
    "douyin-mcp": {
      "command": "uvx",
      "args": ["douyin-mcp-server"],
      "env": {
        "API_KEY": "sk-xxxxxxxxxxxxxxxx"
      }
    }
  }
}

配置后可在 Claude 对话中直接调用:

用户:帮我提取这个视频的文案 https://v.douyin.com/xxxxx/
Claude:[调用 extract_douyin_text 工具]  →  提取完成,文案内容如下...

可用 MCP 工具一览:

工具名 功能 需要 API
parse_douyin_video_info 解析视频信息(标题、ID等)
get_douyin_download_link 获取无水印下载链接
extract_douyin_text 提取视频文案(下载+识别)
recognize_audio_file 识别本地音频文件 ✅(百炼)
recognize_audio_url 识别在线音频链接 ✅(百炼)

方式三:命令行(开发者/批量处理)

# 查看帮助
uv run python douyin-video/scripts/douyin_downloader.py --help

# 获取视频信息(无需 API)
uv run python douyin-video/scripts/douyin_downloader.py \
  -l "分享链接" -a info

# 下载无水印视频
uv run python douyin-video/scripts/douyin_downloader.py \
  -l "分享链接" -a download -o ./videos

# 提取文案
export API_KEY="sk-xxx"
uv run python douyin-video/scripts/douyin_downloader.py \
  -l "分享链接" -a extract -o ./output

# 提取文案并保存视频
uv run python douyin-video/scripts/douyin_downloader.py \
  -l "分享链接" -a extract -o ./output --save_video

输出格式

output/
└── {video_id}/
    ├── transcript.md    # 文案文件(Markdown 格式)
    └── *.mp4             # 视频文件(可选)

transcript.md 示例结构:

# 视频标题

| 属性 | 值 |
|------|-----|
| 视频ID | `7600361826030865707` |
| 提取时间 | 2026-01-30 14:19:00 |
| 下载链接 | [点击下载](url) |

---

## 文案内容

这里是 AI 识别的语音文案...

大文件自动分段

当音频超过 1 小时或 50MB 时,工具自动: 1. 用 FFmpeg 切分为 9 分钟片段 2. 逐段调用 SenseVoice API 转录 3. 合并所有文本结果

典型适用场景

  • 内容创作者素材收集:批量提取同领域竞品视频文案,做竞品分析和选题参考
  • 学术研究:提取短视频的口语语料,用于语言学研究或内容分析(如舆情分析、社媒研究)
  • 字幕/文案整理:将口播视频转文字,用于再创作或存档
  • AI 训练数据收集:构建短视频语音数据集
  • 媒体监测:监测特定话题下的视频内容,无需手动观看

坑与注意

  1. API Key 区分:硅基流动 API Key 和阿里云百炼 Key 是两套;新版用硅基流动(API_KEY),旧版用百炼(DASHSCOPE_API_KEY),二者设一即可。最新文档已更新,建议优先使用硅基流动。
  2. FFmpeg 必需:音频提取依赖 FFmpeg,未安装会报错;Windows 用户可从 ffmpeg.org 下载。
  3. 分享链接格式:抖音分享链接通常形如 https://v.douyin.com/xxxxx/,需要是有效链接,失效或已删视频无法处理。
  4. 下载接口安全:新版本(WebUI 安全加固后)下载接口不再代理任意 URL,默认仅监听本机,防止被滥用。
  5. 仅供学习研究:项目 README 明确声明「仅供学习和研究使用」,请遵守相关法律法规,禁止用于侵犯知识产权的行为。
  6. API 限额:硅基流动新用户有免费额度,但有 QPS/日限额;大批量提取需要注意频率控制。
  7. 长音频处理:超过 1 小时/50MB 的视频会自动分段,但每段仍需调用 API,注意用量。

与同类对比

douyin-mcp-server 各类在线解析网站 yt-dlp
无水印下载
AI 文案提取
MCP 协议
Claude Desktop 集成
本地运行/离线
大文件自动分段
WebUI
维护状态 活跃更新 不稳定(网站常关闭) 非常活跃

相比在线解析网站,douyin-mcp-server 提供 AI 语音识别 + 可编程接口;相比通用下载工具 yt-dlp,它专门针对抖音生态优化且自带 ASR 文案提取能力。

一句话推荐结论

需要在 AI 工作流中批量提取抖音视频文案(非手动下载+转写),或希望用自然语言让 Claude 帮你分析短视频内容的,douyin-mcp-server 是目前最顺滑的开源方案;单纯下载视频推荐用 yt-dlp。