waooAI/waoowaoo · 上手攻略

  • 仓库:waooAI/waoowaoo
  • 链接:https://github.com/waooAI/waoowaoo
  • 分类:AI 工具 · 视频生成
  • 作者:Tom
  • 更新:2026-07-14

这是什么

waoowaoo 是首家工业级全流程 AI 影视生产平台,基于 AI 技术从小说文本自动生成分镜、角色、场景,并制作成完整短剧/漫画视频。它由单一开发者(saturndec)维护,目前处于测试初期阶段,官方定位为"短剧/漫画视频制作工具",核心思路是:输入小说文本 → AI 自动拆解剧本 → 生成一致角色和场景图片 → 分镜合成视频 → AI 配音 → 输出完整短剧

技术栈为 Next.js 15 + React 19 前端,MySQL + Prisma ORM 做数据持久化,Redis + BullMQ 处理任务队列,NextAuth.js 做认证。平台支持中文/英文界面一键切换。

⚠️ 重要提示:项目 README 明确标注处于测试初期阶段("测试版声明:本项目目前处于测试初期阶段,由于暂时只有我一个人开发,存在部分 bug 和不完善之处"),且更新非常频繁。版本间数据库不兼容,升级时需清空旧数据。


解决什么问题

痛点 waoowaoo 的解法
小说/短剧 IP 想快速可视化 输入小说文本,AI 自动解析角色、场景、剧情,无需手动分镜
制作短剧视频门槛高 全流程工具链:剧本分析→角色生成→分镜→配音,一站式
多角色配音成本高 内置 AI 语音合成,多角色分别配音
视频制作周期长 自动化分镜和场景图片生成,大幅压缩制作时间
需要多语言版本 中文/英文界面,右上角一键切换

快速安装(Docker 方式,下载即用)

前提条件

安装 Docker Desktop

方式一:下载即用(推荐,无需 clone)

# 下载 docker-compose.yml
curl -O https://raw.githubusercontent.com/saturndec/waoowaoo/main/docker-compose.yml

# 启动所有服务
docker compose up -d

访问 http://localhost:13000 开始使用。

方式二:下载即用(带构建)

# clone 仓库
git clone https://github.com/saturndec/waoowaoo.git
cd waoowaoo

# 启动所有服务(包含构建)
docker compose up -d

访问 http://localhost:13000 开始使用。

⚠️ 升级时的数据库清空

测试版期间数据库格式可能变化,升级前必须清空旧数据:

docker compose down -v
docker rmi ghcr.io/saturndec/waoowaoo:latest
curl -O https://raw.githubusercontent.com/saturndec/waoowaoo/main/docker-compose.yml
docker compose up -d

另外,启动后需清空浏览器缓存并重新登录,避免旧版本缓存导致异常。


源码开发模式安装(方式三)

适用于需要自定义或参与开发的高级用户:

# clone 仓库
git clone https://github.com/saturndec/waoowaoo.git
cd waoowaoo

# 复制环境变量文件(必须在 npm install 之前完成)
cp .env.example .env
# ⚠️ 编辑 .env,填入你的 AI API Key
# 注意:NEXTAUTH_URL 默认已是 http://localhost:3000,无需修改

npm install

# 只启动基础设施(MySQL/Redis/MinIO)
docker compose up mysql redis minio -d

# 初始化数据库表结构(首次必须执行,跳过会导致启动后报错 The table 'tasks' does not exist)
npx prisma db push

# 启动开发服务器
npm run dev

访问 http://localhost:30000 开始使用。

⚠️ 必读:跳过 npx prisma db push 会导致数据库表不存在,所有功能报错。请务必在启动开发服务器之前执行此命令。


核心功能一览

🎬 AI 剧本分析

上传或粘贴小说文本后,AI 自动解析: - 角色列表(姓名、性格、身份) - 场景描述(时间、地点、环境) - 剧情走向(分段落提取关键情节点)

🎨 角色 & 场景生成

AI 生成一致性人物和场景图片,支持: - 角色换装/换场景时保持人物一致性 - 多场景图片批量生成

注:一致性依赖所用 AI 模型的能力,建议在设置中心配置 AI 服务 API Key。

📽️ 分镜视频制作

根据剧本分析结果自动生成分镜头脚本,并将图片合成为视频: - 自动切片分镜 - 支持视频时长和帧率配置

🎙️ AI 配音

多角色语音合成: - 支持不同角色的音色区分 - 自动与分镜时间轴对齐

🌐 多语言支持

中文 / 英文界面,右上角一键切换,适合出海内容制作。


配置说明

环境变量(.env)

启动后进入设置中心配置 AI 服务的 API Key,内置配置教程。

⚠️ 当前版本仅推荐使用各服务商官方 API,第三方 OpenAI Compatible 格式尚不完善("目前仅推荐使用各服务商官方 API,第三方兼容格式(OpenAI Compatible)尚不完善,后续版本会持续优化")。

基础设施端口映射

服务 端口
MySQL 13306
Redis 16379
MinIO 19000
主应用(docker-compose 方式) 13000
主应用(开发模式) 30000

典型使用场景

场景一:小说 IP 快速可视化

将原创小说粘贴进平台,AI 自动分析剧本并生成分镜图片和视频,用于: - 版权展示和 IP 推介 - 社交媒体短剧内容快速生产 - 验证故事脚本的视觉效果

场景二:短剧批量制作

工作室或内容团队以 waoowaoo 为核心工具流水线生产短剧: - 小说文本 → AI 剧本分析 → 角色生成 → 分镜 → 配音 → 视频导出 - 多语言版本(中文/英文切换)用于国内外平台分发

场景三:漫画视频化

将漫画分镜文字描述提取后输入,生成配套视频,实现图文内容的视频化转型。


坑与注意

  1. 测试版阶段,版本升级需清数据:README 明确说明"当前为测试版,版本间数据库不兼容"。升级前务必 docker compose down -v,否则极大概率报错。

  2. 目前只有单一维护者:开发进度和 BUG 修复依赖个人,响应速度不确定。使用前建议加群反馈或关注 GitHub Releases。

  3. 升级后必须清浏览器缓存:旧版本缓存会导致异常登录或样式问题,每次升级后都要清缓存。

  4. API Key 必须使用官方格式:第三方兼容 API 目前不完善,建议直接使用各 AI 服务商的官方 API key(如 OpenAI、Anthropic 等)。

  5. Docker 方式是最稳的启动方式:开发模式依赖 npm run devnpx prisma db push 的正确顺序执行,对环境要求更高。生产或快速体验建议用 Docker 方式。

  6. PR 不直接合并:README 明确说"最终由团队自行实现修复,不会直接合并外部 PR",所以贡献方式主要是 Issue 反馈,而非直接提交代码合并。

  7. MySQL 端口非标准:compose 配置把 MySQL 映射到 13306 而非标准 3306,需注意连接字符串配置。


与同类对比

工具 核心能力 自动化程度 技术栈 成熟度 适用场景
waoowaoo 小说→分镜→视频全流程 高(一键输入小说) Next.js + MySQL + AI 测试期,较早期 短剧/漫画视频化
Runway Gen-2/Gen-3 AI 视频生成 中(文本/图片→视频) 自研模型 成熟商用 广告/创意视频
Pika AI 视频生成 中(文本/图片→视频) 自研模型 成熟商用 社媒内容
剪映(字节) 视频剪辑 + AI 能力 中(有模板和AI功能) 自研 成熟商用 大众视频剪辑
SD + ComfyUI 图片/视频生成 低(工作流需手动搭) 开源生态 成熟但复杂 专业 AI 艺术创作

waoowaoo 的差异化在于专注于小说/剧本到短剧视频的端到端自动化,而非通用视频剪辑或 AI 生成。竞品多为纯 AI 生成工具,缺乏剧本理解和分镜规划能力。


一句话推荐结论

waoowaoo 是一个很有野心的赛道切入——用 AI 把小说文本直接变成短剧视频,方向独特,虽然目前仍在测试期且依赖单一维护者,但如果你有大量短剧内容生产需求,值得积极关注和内测体验。