rome-os/rome · 上手攻略
- 仓库:rome-os/rome
- 链接:https://github.com/rome-os/rome
- 分类:agent
- 作者:Jay
- 更新:2026-08-28
是什么
Rome 是 agentic OS——一个以 AI Agent 为中心、人类与 Agent 长期协同工作的守卫(guardrailed)环境。与普通对话式 AI 不同,Rome 中的 Agent 不仅执行单次任务,还会随着使用积累工具、SOP、记忆和工作流,每一次交互都在抬高下一次的天花板。
核心哲学来自其 VISION.md:AI 进步的主流叙事在 scaling模型,Rome 选择 scaling 环境——Agent 所处的工具、记忆和接口。
关键概念
| 概念 | 含义 |
|---|---|
| Guardian | 人类用户,Agent 的监督者 |
| Agent | Rome 中Owned的 AI 协作体,有自己的指令和工具 |
| Rome App | 带持久化数据的目的构建产品,存活于对话结束之后 |
| Capability | Rome 发现和复用的最小单位;App 是 Capability 的用户界面 |
| Workflow | 一次性动词任务,执行返回结果 |
| Skill | Agent 按需加载的纯语言流程 |
解决什么问题
普通 Agent(ChatGPT、Claude 单次对话、AutoGPT 类)存在三大局限:
- 上下文窗口即天花板:对话结束记忆消失,无法积累长期工作流。
- 无结构化环境:Agent 自己决定用什么工具、怎么组织输出,结果不可预期。
- 人类无法有效监督:Agent 在黑箱里跑,过程不透明。
Rome 的解法:让 Agent 在有边界的环境中构建自己的 harness(脚手架)、SOP和工作流,proven capabilities 持久化留存,人类全程指导。
快速安装
Docker 一键启动(推荐)
curl -fsSL https://raw.githubusercontent.com/rome-os/rome/main/scripts/quickstart-docker.sh | bash
仪表盘启动于 http://localhost:7663,默认绑定 loopback。需要对外暴露时加 --bind。数据存储在 Docker 命名卷中,重运行脚本即升级容器不丢数据。遥测默认关闭(需要显式设置 OTEL_EXPORTER_OTLP_ENDPOINT)。
⚠️ 注意:首次启动的 onboarding 端口对所有 loopback 连接开放,机器有多用户的场景不要直接
--bind公网。
查看所有参数:
./scripts/quickstart-docker.sh --help
源码开发模式
依赖:Node.js 24+,Corepack,pnpm 11.6+,Docker + Docker Compose。
git clone https://github.com/rome-os/rome.git
cd rome
corepack enable
pnpm install
pnpm dev:all # 启动本地完整栈:Rome + 可观测性 + 路由 + Web 开发服务器
⚠️ Node.js 24 是预览版,与某些 pnpm 插件可能存在兼容问题,优先使用 Docker 方式。
本地开发默认连接 Rome Cloud(romeos.cc),可通过 ROME_DEV_PANTHEON_ORIGIN 环境变量指向其他部署。
核心用法
Rome App 模型
一个 Rome App = app.yaml manifest + 以下任意组件:
| 组件 | 作用 |
|---|---|
| Actions | Agent 可调用的强类型操作 |
| Agents | App 所有的协作 Agent,有独立指令和工具 |
| Skills | 按需加载的语言流程 |
| Hooks | 扩展消息/事件/Agent-turn 生命周期 |
| Web UI & APIs | 目的构建界面和 App 拥有的 HTTP 端点 |
| Database & Files | App 私有持久化状态 |
App 源码是普通 git-tracked 代码,不存在隐藏的模型状态。私有、迭代或发布到 App Store 均可。
典型使用模式
代码审查循环:
"Fix all P1 and P2 review comments until there are no merge blockers left. Let me know when you finish."
邮件管理:
"Sort my inbox. Archive the noise, flag anything urgent, and draft replies for messages that need me."
价格追踪:
"Track the price of this game and let me know when it drops below $30."
客户访谈:
"Interview five customers about onboarding. Ask follow-up questions and summarize what we should improve."
SDK
构建 Rome App 的两个公开 SDK:
# 后端能力 SDK
@rome-os/app-runtime
# Web SDK(含 App 构建 CLI)
@rome-os/app-web-sdk
文档:romeos.cc/docs/building-apps
代码校验命令
pnpm typecheck
pnpm test:unit
pnpm lint
pnpm build
典型适用场景
- 长期多步骤 Agent 任务:代码审查、邮件处理、持续追踪任务,Agent 在每次会话中积累上下文
- 人机协同工作流:人类监督 + Agent 执行,provenance 可查
- 定期自动化:早间简报、价格监控、arXiv 论文摘要等定时任务
- 团队知识沉淀:Rome App 作为可安装、可分享的工作单元沉淀在组织内
坑与注意
- Node.js 24 门槛:开发模式依赖 Node.js 24(截至 2026-08 为预览版),部分 pnpm 插件可能出现兼容问题;Docker 方式无此问题。
- 生产自托管仍在完善:README 明确指出
pnpm dev:all是贡献者开发路径,非最终生产自托管发行版。 - onboarding 端口安全:Docker 默认绑定 loopback,需要
--bind才会暴露,公网部署需配合认证层。 - Agent 记忆持久化依赖:Agent 积累的 SOP 和工具依赖 Rome 的持久层,数据库损坏可能影响 Agent 行为连续性——需定期备份 Docker 卷。
- 生态仍早期:Star 379,周增 +140,成熟度标注为 research,生产环境使用前建议确认最新版本。
与同类对比
| Rome | AutoGPT | n8n | LangChain Agents | |
|---|---|---|---|---|
| 定位 | Agentic OS / 产品 | 单次任务 Agent | 工作流自动化(人用) | Agent 开发框架 |
| 持久化 | ✅ 强,App 级持久 | ❌ 无 | ✅ 工作流持久 | ❌ 无 |
| Guardrails | ✅ 有边界环境 | ❌ 无 | ✅ 节点级控制 | ⚠️ 需自行实现 |
| Human-in-loop | ✅ Guardian 监督 | ❌ 自主运行 | ✅ 节点审批 | ⚠️ 需自行实现 |
| 上手门槛 | 中(Docker 开箱即用) | 低 | 中(工作流编辑器) | 高(代码) |
| 自进化能力 | ✅ Agent 自建 SOP | ❌ 无 | ❌ 靠人工设计 | ⚠️ 靠 LangSmith 追踪 |
一句话推荐结论:如果你希望 Agent 在长期工作中积累自己的工具和工作流,而非每次从零开始,Rome 是目前最成熟的开源实现;如果你只需要单次任务执行或工作流自动化,n8n/AutoGPT 更轻量。
官方文档
- 产品文档:https://romeos.cc/docs/rome
- 构建 App:https://romeos.cc/docs/building-apps
- Vision:https://github.com/rome-os/rome/blob/main/VISION.md
- 架构文档:https://github.com/rome-os/rome/tree/main/docs/architecture
- App Store:https://romeos.cc/store