waooAI/waoowaoo · 上手攻略
- 仓库:waooAI/waoowaoo
- 链接:https://github.com/waooAI/waoowaoo
- 分类:AI 工具 · 视频生成
- 作者:Tom
- 更新:2026-07-14
这是什么
waoowaoo 是首家工业级全流程 AI 影视生产平台,基于 AI 技术从小说文本自动生成分镜、角色、场景,并制作成完整短剧/漫画视频。它由单一开发者(saturndec)维护,目前处于测试初期阶段,官方定位为"短剧/漫画视频制作工具",核心思路是:输入小说文本 → AI 自动拆解剧本 → 生成一致角色和场景图片 → 分镜合成视频 → AI 配音 → 输出完整短剧。
技术栈为 Next.js 15 + React 19 前端,MySQL + Prisma ORM 做数据持久化,Redis + BullMQ 处理任务队列,NextAuth.js 做认证。平台支持中文/英文界面一键切换。
⚠️ 重要提示:项目 README 明确标注处于测试初期阶段("测试版声明:本项目目前处于测试初期阶段,由于暂时只有我一个人开发,存在部分 bug 和不完善之处"),且更新非常频繁。版本间数据库不兼容,升级时需清空旧数据。
解决什么问题
| 痛点 | waoowaoo 的解法 |
|---|---|
| 小说/短剧 IP 想快速可视化 | 输入小说文本,AI 自动解析角色、场景、剧情,无需手动分镜 |
| 制作短剧视频门槛高 | 全流程工具链:剧本分析→角色生成→分镜→配音,一站式 |
| 多角色配音成本高 | 内置 AI 语音合成,多角色分别配音 |
| 视频制作周期长 | 自动化分镜和场景图片生成,大幅压缩制作时间 |
| 需要多语言版本 | 中文/英文界面,右上角一键切换 |
快速安装(Docker 方式,下载即用)
前提条件
安装 Docker Desktop。
方式一:下载即用(推荐,无需 clone)
# 下载 docker-compose.yml
curl -O https://raw.githubusercontent.com/saturndec/waoowaoo/main/docker-compose.yml
# 启动所有服务
docker compose up -d
访问 http://localhost:13000 开始使用。
方式二:下载即用(带构建)
# clone 仓库
git clone https://github.com/saturndec/waoowaoo.git
cd waoowaoo
# 启动所有服务(包含构建)
docker compose up -d
访问 http://localhost:13000 开始使用。
⚠️ 升级时的数据库清空
测试版期间数据库格式可能变化,升级前必须清空旧数据:
docker compose down -v
docker rmi ghcr.io/saturndec/waoowaoo:latest
curl -O https://raw.githubusercontent.com/saturndec/waoowaoo/main/docker-compose.yml
docker compose up -d
另外,启动后需清空浏览器缓存并重新登录,避免旧版本缓存导致异常。
源码开发模式安装(方式三)
适用于需要自定义或参与开发的高级用户:
# clone 仓库
git clone https://github.com/saturndec/waoowaoo.git
cd waoowaoo
# 复制环境变量文件(必须在 npm install 之前完成)
cp .env.example .env
# ⚠️ 编辑 .env,填入你的 AI API Key
# 注意:NEXTAUTH_URL 默认已是 http://localhost:3000,无需修改
npm install
# 只启动基础设施(MySQL/Redis/MinIO)
docker compose up mysql redis minio -d
# 初始化数据库表结构(首次必须执行,跳过会导致启动后报错 The table 'tasks' does not exist)
npx prisma db push
# 启动开发服务器
npm run dev
访问 http://localhost:30000 开始使用。
⚠️ 必读:跳过
npx prisma db push会导致数据库表不存在,所有功能报错。请务必在启动开发服务器之前执行此命令。
核心功能一览
🎬 AI 剧本分析
上传或粘贴小说文本后,AI 自动解析: - 角色列表(姓名、性格、身份) - 场景描述(时间、地点、环境) - 剧情走向(分段落提取关键情节点)
🎨 角色 & 场景生成
AI 生成一致性人物和场景图片,支持: - 角色换装/换场景时保持人物一致性 - 多场景图片批量生成
注:一致性依赖所用 AI 模型的能力,建议在设置中心配置 AI 服务 API Key。
📽️ 分镜视频制作
根据剧本分析结果自动生成分镜头脚本,并将图片合成为视频: - 自动切片分镜 - 支持视频时长和帧率配置
🎙️ AI 配音
多角色语音合成: - 支持不同角色的音色区分 - 自动与分镜时间轴对齐
🌐 多语言支持
中文 / 英文界面,右上角一键切换,适合出海内容制作。
配置说明
环境变量(.env)
启动后进入设置中心配置 AI 服务的 API Key,内置配置教程。
⚠️ 当前版本仅推荐使用各服务商官方 API,第三方 OpenAI Compatible 格式尚不完善("目前仅推荐使用各服务商官方 API,第三方兼容格式(OpenAI Compatible)尚不完善,后续版本会持续优化")。
基础设施端口映射
| 服务 | 端口 |
|---|---|
| MySQL | 13306 |
| Redis | 16379 |
| MinIO | 19000 |
| 主应用(docker-compose 方式) | 13000 |
| 主应用(开发模式) | 30000 |
典型使用场景
场景一:小说 IP 快速可视化
将原创小说粘贴进平台,AI 自动分析剧本并生成分镜图片和视频,用于: - 版权展示和 IP 推介 - 社交媒体短剧内容快速生产 - 验证故事脚本的视觉效果
场景二:短剧批量制作
工作室或内容团队以 waoowaoo 为核心工具流水线生产短剧: - 小说文本 → AI 剧本分析 → 角色生成 → 分镜 → 配音 → 视频导出 - 多语言版本(中文/英文切换)用于国内外平台分发
场景三:漫画视频化
将漫画分镜文字描述提取后输入,生成配套视频,实现图文内容的视频化转型。
坑与注意
-
测试版阶段,版本升级需清数据:README 明确说明"当前为测试版,版本间数据库不兼容"。升级前务必
docker compose down -v,否则极大概率报错。 -
目前只有单一维护者:开发进度和 BUG 修复依赖个人,响应速度不确定。使用前建议加群反馈或关注 GitHub Releases。
-
升级后必须清浏览器缓存:旧版本缓存会导致异常登录或样式问题,每次升级后都要清缓存。
-
API Key 必须使用官方格式:第三方兼容 API 目前不完善,建议直接使用各 AI 服务商的官方 API key(如 OpenAI、Anthropic 等)。
-
Docker 方式是最稳的启动方式:开发模式依赖
npm run dev和npx prisma db push的正确顺序执行,对环境要求更高。生产或快速体验建议用 Docker 方式。 -
PR 不直接合并:README 明确说"最终由团队自行实现修复,不会直接合并外部 PR",所以贡献方式主要是 Issue 反馈,而非直接提交代码合并。
-
MySQL 端口非标准:compose 配置把 MySQL 映射到 13306 而非标准 3306,需注意连接字符串配置。
与同类对比
| 工具 | 核心能力 | 自动化程度 | 技术栈 | 成熟度 | 适用场景 |
|---|---|---|---|---|---|
| waoowaoo | 小说→分镜→视频全流程 | 高(一键输入小说) | Next.js + MySQL + AI | 测试期,较早期 | 短剧/漫画视频化 |
| Runway Gen-2/Gen-3 | AI 视频生成 | 中(文本/图片→视频) | 自研模型 | 成熟商用 | 广告/创意视频 |
| Pika | AI 视频生成 | 中(文本/图片→视频) | 自研模型 | 成熟商用 | 社媒内容 |
| 剪映(字节) | 视频剪辑 + AI 能力 | 中(有模板和AI功能) | 自研 | 成熟商用 | 大众视频剪辑 |
| SD + ComfyUI | 图片/视频生成 | 低(工作流需手动搭) | 开源生态 | 成熟但复杂 | 专业 AI 艺术创作 |
waoowaoo 的差异化在于专注于小说/剧本到短剧视频的端到端自动化,而非通用视频剪辑或 AI 生成。竞品多为纯 AI 生成工具,缺乏剧本理解和分镜规划能力。
一句话推荐结论
waoowaoo 是一个很有野心的赛道切入——用 AI 把小说文本直接变成短剧视频,方向独特,虽然目前仍在测试期且依赖单一维护者,但如果你有大量短剧内容生产需求,值得积极关注和内测体验。