rome-os/rome · 上手攻略

  • 仓库:rome-os/rome
  • 链接:https://github.com/rome-os/rome
  • 分类:agent
  • 作者:Jay
  • 更新:2026-08-28

是什么

Rome 是 agentic OS——一个以 AI Agent 为中心、人类与 Agent 长期协同工作的守卫(guardrailed)环境。与普通对话式 AI 不同,Rome 中的 Agent 不仅执行单次任务,还会随着使用积累工具、SOP、记忆和工作流,每一次交互都在抬高下一次的天花板。

核心哲学来自其 VISION.md:AI 进步的主流叙事在 scaling模型,Rome 选择 scaling 环境——Agent 所处的工具、记忆和接口。

关键概念

概念 含义
Guardian 人类用户,Agent 的监督者
Agent Rome 中Owned的 AI 协作体,有自己的指令和工具
Rome App 带持久化数据的目的构建产品,存活于对话结束之后
Capability Rome 发现和复用的最小单位;App 是 Capability 的用户界面
Workflow 一次性动词任务,执行返回结果
Skill Agent 按需加载的纯语言流程

解决什么问题

普通 Agent(ChatGPT、Claude 单次对话、AutoGPT 类)存在三大局限:

  1. 上下文窗口即天花板:对话结束记忆消失,无法积累长期工作流。
  2. 无结构化环境:Agent 自己决定用什么工具、怎么组织输出,结果不可预期。
  3. 人类无法有效监督:Agent 在黑箱里跑,过程不透明。

Rome 的解法:让 Agent 在有边界的环境中构建自己的 harness(脚手架)、SOP和工作流,proven capabilities 持久化留存,人类全程指导。

快速安装

Docker 一键启动(推荐)

curl -fsSL https://raw.githubusercontent.com/rome-os/rome/main/scripts/quickstart-docker.sh | bash

仪表盘启动于 http://localhost:7663,默认绑定 loopback。需要对外暴露时加 --bind。数据存储在 Docker 命名卷中,重运行脚本即升级容器不丢数据。遥测默认关闭(需要显式设置 OTEL_EXPORTER_OTLP_ENDPOINT)。

⚠️ 注意:首次启动的 onboarding 端口对所有 loopback 连接开放,机器有多用户的场景不要直接 --bind 公网。

查看所有参数:

./scripts/quickstart-docker.sh --help

源码开发模式

依赖:Node.js 24+,Corepack,pnpm 11.6+,Docker + Docker Compose。

git clone https://github.com/rome-os/rome.git
cd rome
corepack enable
pnpm install
pnpm dev:all   # 启动本地完整栈:Rome + 可观测性 + 路由 + Web 开发服务器

⚠️ Node.js 24 是预览版,与某些 pnpm 插件可能存在兼容问题,优先使用 Docker 方式。

本地开发默认连接 Rome Cloud(romeos.cc),可通过 ROME_DEV_PANTHEON_ORIGIN 环境变量指向其他部署。

核心用法

Rome App 模型

一个 Rome App = app.yaml manifest + 以下任意组件:

组件 作用
Actions Agent 可调用的强类型操作
Agents App 所有的协作 Agent,有独立指令和工具
Skills 按需加载的语言流程
Hooks 扩展消息/事件/Agent-turn 生命周期
Web UI & APIs 目的构建界面和 App 拥有的 HTTP 端点
Database & Files App 私有持久化状态

App 源码是普通 git-tracked 代码,不存在隐藏的模型状态。私有、迭代或发布到 App Store 均可。

典型使用模式

代码审查循环:

"Fix all P1 and P2 review comments until there are no merge blockers left. Let me know when you finish."

邮件管理:

"Sort my inbox. Archive the noise, flag anything urgent, and draft replies for messages that need me."

价格追踪:

"Track the price of this game and let me know when it drops below $30."

客户访谈:

"Interview five customers about onboarding. Ask follow-up questions and summarize what we should improve."

SDK

构建 Rome App 的两个公开 SDK:

# 后端能力 SDK
@rome-os/app-runtime

# Web SDK(含 App 构建 CLI)
@rome-os/app-web-sdk

文档:romeos.cc/docs/building-apps

代码校验命令

pnpm typecheck
pnpm test:unit
pnpm lint
pnpm build

典型适用场景

  • 长期多步骤 Agent 任务:代码审查、邮件处理、持续追踪任务,Agent 在每次会话中积累上下文
  • 人机协同工作流:人类监督 + Agent 执行,provenance 可查
  • 定期自动化:早间简报、价格监控、arXiv 论文摘要等定时任务
  • 团队知识沉淀:Rome App 作为可安装、可分享的工作单元沉淀在组织内

坑与注意

  1. Node.js 24 门槛:开发模式依赖 Node.js 24(截至 2026-08 为预览版),部分 pnpm 插件可能出现兼容问题;Docker 方式无此问题。
  2. 生产自托管仍在完善:README 明确指出 pnpm dev:all 是贡献者开发路径,非最终生产自托管发行版。
  3. onboarding 端口安全:Docker 默认绑定 loopback,需要 --bind 才会暴露,公网部署需配合认证层。
  4. Agent 记忆持久化依赖:Agent 积累的 SOP 和工具依赖 Rome 的持久层,数据库损坏可能影响 Agent 行为连续性——需定期备份 Docker 卷。
  5. 生态仍早期:Star 379,周增 +140,成熟度标注为 research,生产环境使用前建议确认最新版本。

与同类对比

Rome AutoGPT n8n LangChain Agents
定位 Agentic OS / 产品 单次任务 Agent 工作流自动化(人用) Agent 开发框架
持久化 ✅ 强,App 级持久 ❌ 无 ✅ 工作流持久 ❌ 无
Guardrails ✅ 有边界环境 ❌ 无 ✅ 节点级控制 ⚠️ 需自行实现
Human-in-loop ✅ Guardian 监督 ❌ 自主运行 ✅ 节点审批 ⚠️ 需自行实现
上手门槛 中(Docker 开箱即用) 中(工作流编辑器) 高(代码)
自进化能力 ✅ Agent 自建 SOP ❌ 无 ❌ 靠人工设计 ⚠️ 靠 LangSmith 追踪

一句话推荐结论:如果你希望 Agent 在长期工作中积累自己的工具和工作流,而非每次从零开始,Rome 是目前最成熟的开源实现;如果你只需要单次任务执行或工作流自动化,n8n/AutoGPT 更轻量。

官方文档

  • 产品文档:https://romeos.cc/docs/rome
  • 构建 App:https://romeos.cc/docs/building-apps
  • Vision:https://github.com/rome-os/rome/blob/main/VISION.md
  • 架构文档:https://github.com/rome-os/rome/tree/main/docs/architecture
  • App Store:https://romeos.cc/store