ApodexAI/FrontierAgent · 上手攻略

  • 仓库:ApodexAI/FrontierAgent
  • 链接:https://github.com/ApodexAI/FrontierAgent
  • 分类:AI Agent Framework
  • 作者:Tom
  • 更新:2026-08-27

是什么

FrontierAgent 是 ApodexAI 开源的一个agent 运行时 + 终端产品 + 评测套件三位一体项目,定位是"长程研究代理和基于文件工作的完整解决方案"。核心由三层组成:

  • TUI 终端:交互式命令界面,支持实时任务面板、审批流、异步干预。
  • Workflow 引擎:两种内置工作流——ReAct(单 agent 状态机)和 Agent Team(协调者 + 并行子 agent)。
  • 评测层:内置 FrontierSearchBench / FrontierChallenge 等 benchmark,支持研究类和文件类任务的自动评测。

配套 Apodex 商业平台(API Key 接入),也支持自托管 SGLang 模型。


解决什么问题

长程 agent 任务长期面临几个痛点:

  1. 缺乏结构化并行:传统 ReAct agent 顺序执行,多任务场景效率低。
  2. 文件操作风险:agent 在真实目录中写入文件,缺乏沙箱保护。
  3. 缺乏可复现评测:自研 agent 缺乏标准 benchmark,只能靠"体感"。
  4. 运营不透明:任务进度、审批状态、子 agent 产出缺乏实时可见性。

FrontierAgent 用 Task Board(任务看板)+ 沙箱文件系统 + 内置评测三件套解决。


快速安装

环境要求

  • Git
  • Python 3.12
  • uv(Astral 出品的 Python 包管理器)
  • OpenAI 兼容模型端点(自托管或商业 API)
  • Docker(可选,用于容器化运行)

基础安装(托管端点,macOS / Linux)

git clone https://github.com/ApodexAI/FrontierAgent.git
cd FrontierAgent

uv sync --python 3.12 --extra dev
cp .env.example .env

编辑 .env 填入:

OPENAI_API_KEY=your-key
OPENAI_BASE_URL=https://your-openai-compatible-endpoint/v1
OPENAI_MODEL=your-model-name

# 可选:网页研究工具
SERPER_API_KEY=
JINA_API_KEY=

启动 TUI:

# 单 Agent ReAct 模式
uv run frontier-agent --mode react --cwd /path/to/project

# Agent Team 协调者模式
uv run frontier-agent --mode agent_team --cwd /path/to/project

⚠️ SGLang 本地服务版本与驱动/CUDA 版本强绑定,出现 Triton kernel 错误时请对照 GPU compatibility matrix 核验驱动版本。

懒人脚本(macOS / Linux)

# macOS
./scripts/run-macos.sh

# Linux(仅端点)
./scripts/run-linux.sh

# Linux + 本地 SGLang GPU(需 NVIDIA)
./scripts/run-linux-gpu.sh --install-system-deps --setup-only

Docker 方式

# 克隆后
cd FrontierAgent
docker compose up

核心用法

ReAct 模式(单 Agent 状态机)

适合:单项目研究、文档撰写、代码修改。

uv run frontier-agent --mode react --cwd ./my-project
  • agent 在任务范围内读写文件,迭代交付产出物。
  • /inputs 只读,/workspace 可写,/outputs 存放最终交付物。
  • 写操作会弹出 diff 审批界面,可加 --yes 跳过。

Agent Team 模式(协调者 + 并行子 Agent)

适合:多方向并行调研、多模块并行开发。

uv run frontier-agent --mode agent_team --cwd ./my-project
  • 协调者接收任务 → 拆解子任务 → 分派给并行子 agent。
  • TUI 侧边栏实时显示 Task Board(pending / active / completed / blocked / cancelled)。
  • 可选 fast reporter 做最终证据复核。
  • 运行时输入会进入指令队列,下一个安全边界注入,不中断正在运行的 sub-agent。

评测模式

# 安装评测依赖
uv sync --python 3.12 --extra dev

# 运行评测
uv run frontier-agent eval --benchmark frontier_search_bench

⚠️ 评测结果需要配置 judge 模型,未配置时评测层不会自动运行。详见 eval.md

常用命令行参数

参数 说明
--mode react\|agent_team 选择工作流模式
--cwd <path> 任务根目录
--yes 跳过所有审批确认
--resume 恢复已保存的运行
uv run frontier-agent --help 查看完整参数列表

会话恢复

uv run frontier-agent --resume
# 或在 TUI 内
/revert   # 恢复 session 变更

典型适用场景

  • 多方向并行调研:产品调研 + 技术评估 + 竞品分析同时跑。
  • 代码库研究:不了解的大型 repo,用 agent 读文件、做分析、写报告。
  • 评测自己的 agent:用 FrontierAgent 内置 harness 跑自己的 agent,量化性能。
  • 沙箱文件操作:不确定 agent 会产生什么副作用,先在沙箱里跑一遍。

坑与注意

  1. SGLang 版本与 CUDA 驱动不匹配:这是项目文档明确警告的坑。Triton kernel 报错通常意味着版本错配,对照 gpu-compatibility.md 核验。
  2. Docker 模式下 /outputs 映射:macOS/Docker 下outputs 映射到宿主机的 .apodex/runs/<run-id>/outputs,首次使用建议确认路径存在。
  3. Agent Team 干预是异步的:运行时输入的指令不会立即生效,要等当前 sub-agent 到达安全边界才会注入。
  4. 评测层需单独配置 judge:默认安装不包含评测运行,仅安装 harness。
  5. Python 3.12 强依赖:其他 Python 版本未测试,使用 3.11 或 3.13 可能遇到兼容问题。

与同类对比

维度 FrontierAgent OpenClaw LangChain Agents CrewAI
工作流模式 ReAct + Agent Team 多协议 agent LCEL AgentExecutor Crew → Agents
评测内置 ✅ 完整 harness
沙箱文件 ✅ 任务级沙箱
TUI ✅ 交互式 TUI
商业配套 Apodex API OpenClaw Cloud LangSmith
开源协议 MIT Apache 2.0 MIT MIT

核心差异化:FrontierAgent 把评测层和沙箱层做成框架内置能力,而不只是 agent 执行引擎。对于需要"开发 → 评测 → 迭代"闭环的团队,这点是其他框架不具备的。


一句话推荐结论

如果你需要一个同时能做 agent 执行、沙箱验证、量化评测的完整工作台,FrontierAgent 是目前开源领域最接近这个目标的项目,尤其适合研究型团队和 agent 开发者。


来源:GitHub README · docs/README.md · Tech Blog (apodex.com) · Tech Report (arXiv 2608.23283) · tui-endpoint-quickstart.md · tui-user-guide.md · eval.md · gpu-compatibility.md