FutureUniant/Tailor · 上手攻略
- 仓库:FutureUniant/Tailor
- 链接:https://github.com/FutureUniant/Tailor
- 分类:video
- 作者:Tom
- 更新:2026-08-23
它是什么
Tailor(中文名:泰勒)是一款本地运行的 AI 视频处理桌面工具,涵盖视频智能裁剪、视频生成和视频优化三大类共 10 种功能。核心特点是点点鼠标即可完成专业级剪辑,无需复杂的命令行操作,特别适合中文用户和短视频创作者。
⚠️ 平台限制:目前仅支持 Windows。macOS 和 Linux 用户需通过虚拟机或双系统运行。最新版本为 2024-08-07,功能迭代已停滞约 2 年(截至 2026-08)。
解决什么问题
传统视频剪辑软件(如 Adobe Premiere、Final Cut Pro)功能强大但学习曲线陡峭,且需要手动完成大量重复操作。Tailor 通过 AI 自动化降低了这些门槛:
| 痛点 | Tailor 方案 |
|---|---|
| 剪辑长视频找重点 | 人脸识别 + 语音识别自动定位精彩片段 |
| 口播视频制作成本高 | 上传人像图 + 文字 → 自动生成带语音口型的视频 |
| 字幕制作繁琐 | 语音转字幕,自动与画面同步 |
| 黑白老片修复 | 一键上色,让黑白视频焕发色彩 |
| 视频去卡顿 | 帧插值提升流畅度 |
| 路人/水印去除 | 目标跟踪 + 智能消除 |
快速安装
方式一:安装包(推荐,懒人首选)
直接下载发布版,双击 tailor.exe 即可运行,无需配置任何环境:
| 下载渠道 | 链接 | 提取码 |
|---|---|---|
| GitHub Releases | https://github.com/FutureUniant/Tailor/releases | — |
| 百度网盘 | https://pan.baidu.com/s/1anH2q4GKol7OB2Ue5BsyOA | qeni |
| 123 云盘 | https://www.123pan.com/s/TvpgTd-sd2Yd.html | 74X1 |
⚠️ 百度网盘和 123 云盘的链接为第三方分发,非官方直链,存在链接失效风险,建议优先从 GitHub Releases 下载。
方式二:开发者模式(需配置 Python 环境)
前置依赖:
| 依赖 | 版本 | 说明 |
|---|---|---|
| Python | 3.10(推荐) | 其他 3.x 版本也可 |
| FFmpeg | 6.1.1 | 需放在 extensions/ffmpeg-6.1.1-essentials_build |
| ImageMagick | 7.1.1-29 | 需放在 extensions/ImageMagick-7.1.1-29-portable-Q16-x64 |
安装步骤:
# 1. 克隆仓库
git clone https://github.com/FutureUniant/Tailor.git
cd Tailor
# 2. 安装 Python 依赖
pip install -r requirements.txt
# 3. 下载 FFmpeg(放在项目根目录 extensions 下)
# 下载地址:https://www.gyan.dev/ffmpeg/builds/packages/ffmpeg-6.1.1-essentials_build.7z
# 解压后文件夹重命名为 ffmpeg-6.1.1-essentials_build 放入 extensions/
# 4. 下载 ImageMagick(放在项目根目录 extensions 下)
# 下载地址:https://imagemagick.org/archive/binaries/ImageMagick-7.1.1-29-portable-Q16-x64.zip
# 解压后文件夹重命名为 ImageMagick-7.1.1-29-portable-Q16-x64 放入 extensions/
# 5. 启动
python main.py
⚠️ FFmpeg 和 ImageMagick 的路径和文件夹命名必须严格按上述要求摆放,否则启动会报错。
核心用法
Tailor 有两种使用模式:
- 使用者模式:安装 .exe 后点点鼠标操作 GUI(无编程基础首选)
- 开发者模式:下载代码自行配置,支持二次开发
1. 新建项目
主界面 → 左侧「新建」按钮 → 填写工程名称和保存路径
2. 主要功能一览
视频裁剪类
| 功能 | 说明 | 输入 |
|---|---|---|
| 人脸裁剪 | 识别视频中的人脸,选择特定人物自动裁剪出相关片段 | 待处理视频 |
| 语音裁剪 | 识别视频语音内容,按语义段落精准裁剪 | 待处理视频 |
视频生成类
| 功能 | 说明 | 输入 |
|---|---|---|
| 口播生成 | 上传人像图 + 文字内容 → 生成带口型匹配的语音视频 | 单张人像图 + 文字 |
| 字幕生成 | 语音自动转字幕文字,多种字体/颜色可选 | 视频文件 |
| 色彩生成 | 黑白视频一键上色 | 黑白视频 |
| 图片转视频 | 静态图 + 文字 → 生成配音视频 | 图片 + 文字 |
| 语言更换 | 将视频中的语音翻译/替换为其他语言 | 视频文件 |
⚠️ 口播生成依赖 EmotiVoice(网易有道开源 TTS)和 SadTalker(人脸动画模型),首次运行需要联网下载模型。
视频优化类
| 功能 | 说明 | 输入 |
|---|---|---|
| 背景更换 | 分离前景人物,更换为其他背景图/视频 | 人像视频 + 背景图 |
| 流畅度提升 | 帧插值让低帧率视频更流畅 | 低帧率视频 |
| 清晰度提升 | 超分辨率重建,提升模糊视频的清晰度 | 低分辨率视频 |
| 字幕消除 | 去除视频中的硬字幕(需要重新压制) | 有字幕的视频 |
| 目标消除 | 跟踪并消除视频中的任意目标(路人/杂物) | 待处理视频 |
| 局部处理 | 对特定区域进行聚焦或灰度处理 | 待处理视频 |
3. 批量处理
GUI 支持多流程串联:导入视频 → 选择处理方法 → 自动执行 → 导出。
典型适用场景
| 场景 | 推荐程度 | 说明 |
|---|---|---|
| 自媒体短视频制作 | ✅ 强烈推荐 | 口播/字幕/裁剪一条龙 |
| 老照片/老视频修复 | ✅ 适用 | 上色 + 清晰度提升 |
| 多语言视频本地化 | ⚠️ 一般 | 语音翻译效果有限,适合初稿 |
| 影视二创 | ⚠️ 注意 | 目标消除很好用,但需注意版权 |
| 专业级视频制作 | ❌ 不推荐 | 功能深度不及 Premiere/DaVinci |
坑与注意
-
只有 Windows:macOS 和 Linux 用户无法直接使用,这是最大的平台限制。
-
模型下载问题:口播生成等功能首次运行会从 Hugging Face / ModelScope 下载模型,国内网络可能较慢,需要代理。
-
CUDA 加速需要手动配置:如果期望 GPU 加速,需提前安装 CUDA 和 cuDNN,并正确配置环境变量。
-
功能迭代停滞:项目 2024-08-07 后没有重大更新,2026 年来看部分 AI 功能(尤其是口播生成)已被更新更强的工具(如 HeyGen、D-ID)超越。
-
FFmpeg 依赖严格命名:路径配置非常严格,文件夹命名错误会导致静默失败,新手容易踩坑。
-
分辨率限制:部分生成类功能对输入图片/视频的分辨率有限制,过大或过小都可能失败。
-
开源许可证:使用 Apache-2.0 许可,可商用,但依赖的第三方模型(Whisper、DDColor、EmotiVoice 等)各有其许可证,需分别核查。
与同类对比
| 工具 | 平台 | 核心优势 | 劣势 |
|---|---|---|---|
| Tailor | Windows | 本地运行、中文友好、一站式 | Windows only、迭代停滞 |
| CapCut | 全平台 | 免费、云端强大、更新快 | 依赖云端 |
| 剪映 | 全平台 | 字节生态、操作简单 | 功能深度有限 |
| Runway Gen-2/Gen-3 | Web | 视频生成质量高 | 收费、国内访问受限 |
| HeyGen | Web | 口播生成领先 | 订阅制、价格高 |
一句话结论
Tailor 是中文本地 AI 视频工具中难得的 Windows 桌面一站式方案,人脸裁剪、目标消除等特色功能实用;但平台限制明显且迭代停滞,不适合作为主力生产力工具,更适合作为辅助剪辑台或学习 AI 视频处理原理的入门级工具。