TypeTale/TypeTale · 上手攻略

  • 仓库:TypeTale/TypeTale
  • 链接:https://github.com/TypeTale/TypeTale
  • 分类:AIGC · 视频生成
  • 作者:Tom
  • 更新:2026-08-10

这是什么

字字动画(TypeTale)是一款国产 AIGC 视频创作软件,主要面向 AI 短剧、AI 电影和小说推文(网文转视频)场景。核心思路:从文案到视频的全链路 AI 创作,涵盖文案预处理、智能分镜、图片生成、视频生成、对口型、音频合成,最终一键导出剪映草稿。

承诺现有功能永久免费,提供算力云/仙宫云完整镜像和本地 AI 整合包。系统要求:Windows,推荐 8GB+ 内存,部分功能需要带 AI 加速的显卡(没有也可正常使用基础功能)。


解决什么问题

  • 小说推文视频化:网文作者不需要会剪辑,AI 自动把文字转成分镜、配图、配音、视频,全程流水线。
  • AI 短剧制作:集成 Wan、Veo3、Sora2 等视频生成模型,从剧本到成片一站式完成。
  • 跨模型聚合:图片用 Stable Diffusion WebUI/ComfyUI/Midjourney,视频用 Wan/Veo3/Sora2,语音用 EdgeTTS/GPTSoVITS/IndexTTS2,在一个软件里统一调度,不需要在多个平台间切换。

快速安装

方式一:完整镜像(推荐,零配置)

字字动画在算力云仙宫云有完整镜像,所有 AI 能力开箱即用,只需简单配置 API Key 即可:

# 具体镜像地址和配置见官网
# 官网:https://wcnzyhmsp2tw.feishu.cn/wiki/FwqMwdBgni0aKDkxY6rcEdaWnjc
# 下载后按官方文档填写 AI 模型 API Key

方式二:本地 AI 整合包

# 从官网下载本地整合包(Windows)
# 官网:https://wcnzyhmsp2tw.feishu.cn/wiki/FwqMwdBgni0aKDkxY6rcEdaWnjc

# 解压后运行主程序,按提示配置:
# - 图片模型:StableDiffusion WebUI / ComfyUI / Midjourney / Nano Banana / Qwen 等
# - 视频模型:Wan / Veo3 / Sora2(内置插件或 Comfly 平台)
# - 语音模型:EdgeTTS(免费)/ GPTSoVITS / IndexTTS2
# - 语言模型:阿里云 / 硅基流动 / DeepSeek / OpenAI / Gemini / Claude 等

方式三:插件扩展(进阶)

# 软件支持 Python 插件开发
# 插件目录:_internal/plugins/
# 编写 Python 插件可:
#   - 任意逻辑操作软件并发生图
#   - 编写自己的模型页面
#   - 调用中转平台(Banana / Sora2 等)

# 同时支持 ComfyUI 节点开发
# 可开发 ComfyUI 节点支持任意图片/视频生成源

核心用法流程

标准工作流(小说推文)

文案输入 → 智能分镜 → 角色/场景提取 → 生图提示词推理 → 生成图片 → 生成音频 → 生成视频 → 对口型 → 导出剪映

1. 创建作品

打开软件 → 新建作品 → 选择"剧本模式"或"视频克隆":

# 剧本模式(推荐):输入文案,AI 自动拆解分镜
# 视频克隆:输入视频链接,AI 自动反推分镜和提示词

2. 智能分镜

# 软件自动将长文案切分为多个分镜
# 支持手动重排 + AI 智能重排
# 支持按章节组织,章节推理稳定性高(单章 100 分镜以上可用 Qwen 推理)

3. 角色与场景

# 从故事中提取角色列表和角色描述
# 支持预设角色 + 自定义角色上传
# 角色可"Sora 客串"(跨作品出场)
# 场景同理,支持预设场景和自定义

4. 生成图片

# 配置生图模型(内置 Stable Diffusion / ComfyUI / Midjourney 等)
# 支持批量生成,支持跳过已有图片
# 支持"风格参考":给图片/视频/角色/场景加不同参考图

5. 生成音频

# 语音合成:EdgeTTS(免费)/ GPTSoVITS / IndexTTS2
# 支持多角色配音匹配和情绪推理(IndexTTS2 八维情绪向量)
# 支持后处理:缩短静音、限制限幅、均衡器

6. 生成视频

# 支持 Wan、Veo3、Sora2 等模型
# 文生视频 / 图生视频 / 首帧驱动 / 首尾帧驱动
# 视频提示词体系:图片提示词、视频提示词、首帧提示词、尾帧提示词四类独立

7. 对口型 + 导出剪映

# 自动根据音频对口型,视频与语音完美同步
# 一键生成剪映草稿,批量导出
# 支持 FCP7 XML 导出(达芬奇/PR 通用)

视频克隆(快速复制热门内容)

# 1. 在热门视频列表找对标视频(或输入 URL)
# 2. 点击"视频克隆",软件自动分割分镜
# 3. 批量反推提示词(通过提示词模板"视频反推"调整样式)
# 4. 替换角色/场景,快速产出二创版本

工作流自定义

# 可视化拖拽式工作流设计
# 任意组合已有功能
# 保存为模板,快速复用
# 支持条件分支,实现复杂创作逻辑

典型适用场景

场景 推荐功能
小说推文 剧本模式 → 智能分镜 → Wan/VEo3 视频 → 对口型 → 剪映导出
AI 短剧 分镜推理 → 角色客串 → Sora2/Wan 视频 → 多角色配音
AI 电影 章节推理 → 角色场景 → 多模型视频 → IndexTTS2 多角色
二创翻拍 视频克隆 → 反推提示词 → 替换角色/场景
知识科普视频 剧本模式 → 解说模式 → Wan2.2 视频 → 批量配音

坑与注意

  1. Windows 独占:目前只支持 Windows,macOS/Linux 用户无法直接运行。
  2. 显卡需求不均:基础功能(文案、分镜、配音)不需要显卡;但视频生成(Sora2/Wan)需要支持 AI 加速的 GPU。
  3. 中转平台风险:内置 Banana/Geeknow 等中转插件,文档明确声明"与任何第三方中转平台没有合作",需自行甄别安全性。
  4. API Key 配置复杂:图片模型、视频模型、语音模型、语言模型、视觉理解模型各自独立配置,首次配置项较多。
  5. 提示词模板格式强耦合:章节推理、分镜推理等功能的提示词已多次迭代大版本,用户自定义模板需要按官方新格式重写,否则可能失效。
  6. 大型项目内存压力:100+ 分镜的复杂作品,8GB 内存可能吃紧,建议 16GB+。
  7. 版本更新节奏快:从 changelog 看平均每周有功能迭代,但更新后可能破坏旧版提示词模板,建议重要作品做好版本记录。
  8. 视频模型版权:Sora2/Wan 等模型的生成内容版权归属需参考各模型平台协议,商用前需确认。

与同类对比

特性 字字动画 剪映(专业版) HeyGen D-ID
定位 文案→视频全链路 剪辑工具 数字人视频 数字人驱动
视频生成 ✅ 内置 Wan/Sora2/VEo3
多角色配音 ✅ 多角色+情绪 基础
剪映集成 ✅ 一键导出草稿
ComfyUI 扩展 ✅ 节点级开放
小说推文模板 ✅ 专为网文优化
平台 Windows Windows/Mac/iOS Web Web
价格 免费 免费+会员 付费订阅 付费订阅

一句话:字字动画是目前最专注"中文网文推文→AI视频"这条链路的工具,剪映集成+多模型聚合是亮点;HeyGen/D-ID 更偏数字人驱动,剪映是通用剪辑而非 AI 生成。


一句话推荐结论

中文 AIGC 视频创作的全家桶:字字动画把小说推文、AI 短剧、AI 电影的完整流程封装在 Windows 本地软件里,多模型统一调度+一键导出剪映,永久免费。适合不想学剪辑的内容创作者;显卡配置和 API Key 准备是主要门槛。


来源:GitHub README (https://github.com/TypeTale/TypeTale) · 飞书官网文档 · Release Changelog