FutureUniant/Tailor · 上手攻略

  • 仓库:FutureUniant/Tailor
  • 链接:https://github.com/FutureUniant/Tailor
  • 分类:video
  • 作者:Tom
  • 更新:2026-08-23

它是什么

Tailor(中文名:泰勒)是一款本地运行的 AI 视频处理桌面工具,涵盖视频智能裁剪、视频生成和视频优化三大类共 10 种功能。核心特点是点点鼠标即可完成专业级剪辑,无需复杂的命令行操作,特别适合中文用户和短视频创作者。

⚠️ 平台限制:目前仅支持 Windows。macOS 和 Linux 用户需通过虚拟机或双系统运行。最新版本为 2024-08-07,功能迭代已停滞约 2 年(截至 2026-08)。

解决什么问题

传统视频剪辑软件(如 Adobe Premiere、Final Cut Pro)功能强大但学习曲线陡峭,且需要手动完成大量重复操作。Tailor 通过 AI 自动化降低了这些门槛:

痛点 Tailor 方案
剪辑长视频找重点 人脸识别 + 语音识别自动定位精彩片段
口播视频制作成本高 上传人像图 + 文字 → 自动生成带语音口型的视频
字幕制作繁琐 语音转字幕,自动与画面同步
黑白老片修复 一键上色,让黑白视频焕发色彩
视频去卡顿 帧插值提升流畅度
路人/水印去除 目标跟踪 + 智能消除

快速安装

方式一:安装包(推荐,懒人首选)

直接下载发布版,双击 tailor.exe 即可运行,无需配置任何环境:

下载渠道 链接 提取码
GitHub Releases https://github.com/FutureUniant/Tailor/releases
百度网盘 https://pan.baidu.com/s/1anH2q4GKol7OB2Ue5BsyOA qeni
123 云盘 https://www.123pan.com/s/TvpgTd-sd2Yd.html 74X1

⚠️ 百度网盘和 123 云盘的链接为第三方分发,非官方直链,存在链接失效风险,建议优先从 GitHub Releases 下载。

方式二:开发者模式(需配置 Python 环境)

前置依赖:

依赖 版本 说明
Python 3.10(推荐) 其他 3.x 版本也可
FFmpeg 6.1.1 需放在 extensions/ffmpeg-6.1.1-essentials_build
ImageMagick 7.1.1-29 需放在 extensions/ImageMagick-7.1.1-29-portable-Q16-x64

安装步骤:

# 1. 克隆仓库
git clone https://github.com/FutureUniant/Tailor.git
cd Tailor

# 2. 安装 Python 依赖
pip install -r requirements.txt

# 3. 下载 FFmpeg(放在项目根目录 extensions 下)
# 下载地址:https://www.gyan.dev/ffmpeg/builds/packages/ffmpeg-6.1.1-essentials_build.7z
# 解压后文件夹重命名为 ffmpeg-6.1.1-essentials_build 放入 extensions/

# 4. 下载 ImageMagick(放在项目根目录 extensions 下)
# 下载地址:https://imagemagick.org/archive/binaries/ImageMagick-7.1.1-29-portable-Q16-x64.zip
# 解压后文件夹重命名为 ImageMagick-7.1.1-29-portable-Q16-x64 放入 extensions/

# 5. 启动
python main.py

⚠️ FFmpeg 和 ImageMagick 的路径和文件夹命名必须严格按上述要求摆放,否则启动会报错。

核心用法

Tailor 有两种使用模式:

  • 使用者模式:安装 .exe 后点点鼠标操作 GUI(无编程基础首选)
  • 开发者模式:下载代码自行配置,支持二次开发

1. 新建项目

主界面 → 左侧「新建」按钮 → 填写工程名称和保存路径

2. 主要功能一览

视频裁剪类

功能 说明 输入
人脸裁剪 识别视频中的人脸,选择特定人物自动裁剪出相关片段 待处理视频
语音裁剪 识别视频语音内容,按语义段落精准裁剪 待处理视频

视频生成类

功能 说明 输入
口播生成 上传人像图 + 文字内容 → 生成带口型匹配的语音视频 单张人像图 + 文字
字幕生成 语音自动转字幕文字,多种字体/颜色可选 视频文件
色彩生成 黑白视频一键上色 黑白视频
图片转视频 静态图 + 文字 → 生成配音视频 图片 + 文字
语言更换 将视频中的语音翻译/替换为其他语言 视频文件

⚠️ 口播生成依赖 EmotiVoice(网易有道开源 TTS)和 SadTalker(人脸动画模型),首次运行需要联网下载模型。

视频优化类

功能 说明 输入
背景更换 分离前景人物,更换为其他背景图/视频 人像视频 + 背景图
流畅度提升 帧插值让低帧率视频更流畅 低帧率视频
清晰度提升 超分辨率重建,提升模糊视频的清晰度 低分辨率视频
字幕消除 去除视频中的硬字幕(需要重新压制) 有字幕的视频
目标消除 跟踪并消除视频中的任意目标(路人/杂物) 待处理视频
局部处理 对特定区域进行聚焦或灰度处理 待处理视频

3. 批量处理

GUI 支持多流程串联:导入视频 → 选择处理方法 → 自动执行 → 导出。

典型适用场景

场景 推荐程度 说明
自媒体短视频制作 ✅ 强烈推荐 口播/字幕/裁剪一条龙
老照片/老视频修复 ✅ 适用 上色 + 清晰度提升
多语言视频本地化 ⚠️ 一般 语音翻译效果有限,适合初稿
影视二创 ⚠️ 注意 目标消除很好用,但需注意版权
专业级视频制作 ❌ 不推荐 功能深度不及 Premiere/DaVinci

坑与注意

  1. 只有 Windows:macOS 和 Linux 用户无法直接使用,这是最大的平台限制。

  2. 模型下载问题:口播生成等功能首次运行会从 Hugging Face / ModelScope 下载模型,国内网络可能较慢,需要代理。

  3. CUDA 加速需要手动配置:如果期望 GPU 加速,需提前安装 CUDA 和 cuDNN,并正确配置环境变量。

  4. 功能迭代停滞:项目 2024-08-07 后没有重大更新,2026 年来看部分 AI 功能(尤其是口播生成)已被更新更强的工具(如 HeyGen、D-ID)超越。

  5. FFmpeg 依赖严格命名:路径配置非常严格,文件夹命名错误会导致静默失败,新手容易踩坑。

  6. 分辨率限制:部分生成类功能对输入图片/视频的分辨率有限制,过大或过小都可能失败。

  7. 开源许可证:使用 Apache-2.0 许可,可商用,但依赖的第三方模型(Whisper、DDColor、EmotiVoice 等)各有其许可证,需分别核查。

与同类对比

工具 平台 核心优势 劣势
Tailor Windows 本地运行、中文友好、一站式 Windows only、迭代停滞
CapCut 全平台 免费、云端强大、更新快 依赖云端
剪映 全平台 字节生态、操作简单 功能深度有限
Runway Gen-2/Gen-3 Web 视频生成质量高 收费、国内访问受限
HeyGen Web 口播生成领先 订阅制、价格高

一句话结论

Tailor 是中文本地 AI 视频工具中难得的 Windows 桌面一站式方案,人脸裁剪、目标消除等特色功能实用;但平台限制明显且迭代停滞,不适合作为主力生产力工具,更适合作为辅助剪辑台或学习 AI 视频处理原理的入门级工具。