TypeTale/TypeTale · 上手攻略
- 仓库:TypeTale/TypeTale
- 链接:https://github.com/TypeTale/TypeTale
- 分类:AIGC · 视频生成
- 作者:Tom
- 更新:2026-08-10
这是什么
字字动画(TypeTale)是一款国产 AIGC 视频创作软件,主要面向 AI 短剧、AI 电影和小说推文(网文转视频)场景。核心思路:从文案到视频的全链路 AI 创作,涵盖文案预处理、智能分镜、图片生成、视频生成、对口型、音频合成,最终一键导出剪映草稿。
承诺现有功能永久免费,提供算力云/仙宫云完整镜像和本地 AI 整合包。系统要求:Windows,推荐 8GB+ 内存,部分功能需要带 AI 加速的显卡(没有也可正常使用基础功能)。
解决什么问题
- 小说推文视频化:网文作者不需要会剪辑,AI 自动把文字转成分镜、配图、配音、视频,全程流水线。
- AI 短剧制作:集成 Wan、Veo3、Sora2 等视频生成模型,从剧本到成片一站式完成。
- 跨模型聚合:图片用 Stable Diffusion WebUI/ComfyUI/Midjourney,视频用 Wan/Veo3/Sora2,语音用 EdgeTTS/GPTSoVITS/IndexTTS2,在一个软件里统一调度,不需要在多个平台间切换。
快速安装
方式一:完整镜像(推荐,零配置)
字字动画在算力云和仙宫云有完整镜像,所有 AI 能力开箱即用,只需简单配置 API Key 即可:
# 具体镜像地址和配置见官网
# 官网:https://wcnzyhmsp2tw.feishu.cn/wiki/FwqMwdBgni0aKDkxY6rcEdaWnjc
# 下载后按官方文档填写 AI 模型 API Key
方式二:本地 AI 整合包
# 从官网下载本地整合包(Windows)
# 官网:https://wcnzyhmsp2tw.feishu.cn/wiki/FwqMwdBgni0aKDkxY6rcEdaWnjc
# 解压后运行主程序,按提示配置:
# - 图片模型:StableDiffusion WebUI / ComfyUI / Midjourney / Nano Banana / Qwen 等
# - 视频模型:Wan / Veo3 / Sora2(内置插件或 Comfly 平台)
# - 语音模型:EdgeTTS(免费)/ GPTSoVITS / IndexTTS2
# - 语言模型:阿里云 / 硅基流动 / DeepSeek / OpenAI / Gemini / Claude 等
方式三:插件扩展(进阶)
# 软件支持 Python 插件开发
# 插件目录:_internal/plugins/
# 编写 Python 插件可:
# - 任意逻辑操作软件并发生图
# - 编写自己的模型页面
# - 调用中转平台(Banana / Sora2 等)
# 同时支持 ComfyUI 节点开发
# 可开发 ComfyUI 节点支持任意图片/视频生成源
核心用法流程
标准工作流(小说推文)
文案输入 → 智能分镜 → 角色/场景提取 → 生图提示词推理 → 生成图片 → 生成音频 → 生成视频 → 对口型 → 导出剪映
1. 创建作品
打开软件 → 新建作品 → 选择"剧本模式"或"视频克隆":
# 剧本模式(推荐):输入文案,AI 自动拆解分镜
# 视频克隆:输入视频链接,AI 自动反推分镜和提示词
2. 智能分镜
# 软件自动将长文案切分为多个分镜
# 支持手动重排 + AI 智能重排
# 支持按章节组织,章节推理稳定性高(单章 100 分镜以上可用 Qwen 推理)
3. 角色与场景
# 从故事中提取角色列表和角色描述
# 支持预设角色 + 自定义角色上传
# 角色可"Sora 客串"(跨作品出场)
# 场景同理,支持预设场景和自定义
4. 生成图片
# 配置生图模型(内置 Stable Diffusion / ComfyUI / Midjourney 等)
# 支持批量生成,支持跳过已有图片
# 支持"风格参考":给图片/视频/角色/场景加不同参考图
5. 生成音频
# 语音合成:EdgeTTS(免费)/ GPTSoVITS / IndexTTS2
# 支持多角色配音匹配和情绪推理(IndexTTS2 八维情绪向量)
# 支持后处理:缩短静音、限制限幅、均衡器
6. 生成视频
# 支持 Wan、Veo3、Sora2 等模型
# 文生视频 / 图生视频 / 首帧驱动 / 首尾帧驱动
# 视频提示词体系:图片提示词、视频提示词、首帧提示词、尾帧提示词四类独立
7. 对口型 + 导出剪映
# 自动根据音频对口型,视频与语音完美同步
# 一键生成剪映草稿,批量导出
# 支持 FCP7 XML 导出(达芬奇/PR 通用)
视频克隆(快速复制热门内容)
# 1. 在热门视频列表找对标视频(或输入 URL)
# 2. 点击"视频克隆",软件自动分割分镜
# 3. 批量反推提示词(通过提示词模板"视频反推"调整样式)
# 4. 替换角色/场景,快速产出二创版本
工作流自定义
# 可视化拖拽式工作流设计
# 任意组合已有功能
# 保存为模板,快速复用
# 支持条件分支,实现复杂创作逻辑
典型适用场景
| 场景 | 推荐功能 |
|---|---|
| 小说推文 | 剧本模式 → 智能分镜 → Wan/VEo3 视频 → 对口型 → 剪映导出 |
| AI 短剧 | 分镜推理 → 角色客串 → Sora2/Wan 视频 → 多角色配音 |
| AI 电影 | 章节推理 → 角色场景 → 多模型视频 → IndexTTS2 多角色 |
| 二创翻拍 | 视频克隆 → 反推提示词 → 替换角色/场景 |
| 知识科普视频 | 剧本模式 → 解说模式 → Wan2.2 视频 → 批量配音 |
坑与注意
- Windows 独占:目前只支持 Windows,macOS/Linux 用户无法直接运行。
- 显卡需求不均:基础功能(文案、分镜、配音)不需要显卡;但视频生成(Sora2/Wan)需要支持 AI 加速的 GPU。
- 中转平台风险:内置 Banana/Geeknow 等中转插件,文档明确声明"与任何第三方中转平台没有合作",需自行甄别安全性。
- API Key 配置复杂:图片模型、视频模型、语音模型、语言模型、视觉理解模型各自独立配置,首次配置项较多。
- 提示词模板格式强耦合:章节推理、分镜推理等功能的提示词已多次迭代大版本,用户自定义模板需要按官方新格式重写,否则可能失效。
- 大型项目内存压力:100+ 分镜的复杂作品,8GB 内存可能吃紧,建议 16GB+。
- 版本更新节奏快:从 changelog 看平均每周有功能迭代,但更新后可能破坏旧版提示词模板,建议重要作品做好版本记录。
- 视频模型版权:Sora2/Wan 等模型的生成内容版权归属需参考各模型平台协议,商用前需确认。
与同类对比
| 特性 | 字字动画 | 剪映(专业版) | HeyGen | D-ID |
|---|---|---|---|---|
| 定位 | 文案→视频全链路 | 剪辑工具 | 数字人视频 | 数字人驱动 |
| 视频生成 | ✅ 内置 Wan/Sora2/VEo3 | ❌ | ❌ | ❌ |
| 多角色配音 | ✅ 多角色+情绪 | 基础 | ✅ | ✅ |
| 剪映集成 | ✅ 一键导出草稿 | — | ❌ | ❌ |
| ComfyUI 扩展 | ✅ 节点级开放 | ❌ | ❌ | ❌ |
| 小说推文模板 | ✅ 专为网文优化 | ❌ | ❌ | ❌ |
| 平台 | Windows | Windows/Mac/iOS | Web | Web |
| 价格 | 免费 | 免费+会员 | 付费订阅 | 付费订阅 |
一句话:字字动画是目前最专注"中文网文推文→AI视频"这条链路的工具,剪映集成+多模型聚合是亮点;HeyGen/D-ID 更偏数字人驱动,剪映是通用剪辑而非 AI 生成。
一句话推荐结论
中文 AIGC 视频创作的全家桶:字字动画把小说推文、AI 短剧、AI 电影的完整流程封装在 Windows 本地软件里,多模型统一调度+一键导出剪映,永久免费。适合不想学剪辑的内容创作者;显卡配置和 API Key 准备是主要门槛。
来源:GitHub README (https://github.com/TypeTale/TypeTale) · 飞书官网文档 · Release Changelog