OpenScience 是 Synthetic Sciences(YC W26 入选团队)出品的开源 AI 科研工作台。用户给定一个研究目标,它就以"能力型合作者"的方式走完完整研究闭环——读文献、提假设、写代码、跑实验、查数据库、写报告,全程在一个浏览器 Workspace 里完成。 它于 2026 年 7 月 5 日正式发布,定位是 Claude Sci…
仓库攻略
160 篇 · 158 个项目 · Agent 智能体 · jay
Claude Code 动态工作流(Dynamic Workflows)是 Anthropic 于 2026 年 5 月 28 日(随 Opus 4.8 发布)推出的研究预览功能,核心解决一个长期难题:LLM Agent 的编排逻辑(即"谁在什么时机调用谁")本质上是硬编码的,无法动态适应任务规模。 动态工作流的解法是:让 Claude 自己写一个 Java…
一个多角色 Agent 团队研究工作流:用不同角色的 Agent(侦察员、批评员、总结员)组成研究小队,让它们像真实团队一样协作——各司其职、互相review、自动输出结论——而不是把问题扔给一个 LLM 然后祈祷它答对。 核心洞察来自 @omarsar0(Elvis,DAIR.AI 研究员):同一个 LLM 既写答案又评答案,本身就是盲点。解决方案不是换更…
koreanlawmcp 是一个基于韩国法制处(법제처)Open API 的 MCP(Model Context Protocol)服务器,同时附带 CLI 工具。它将韩国 42 个官方法律 API 压缩为 10 个核心工具,让 AI 助手(Claude Desktop、Cursor、Windsurf、Zed 等)能够实时查询、验证和分析韩国成文法和判例。 …
DataFlowHarness 是北京大学联合中关村 Academy 于 2026 年 7 月 18 日发布的一个代码 Agent 平台(技术报告 arXiv:2607.16617),核心解决一个实际问题:LLM 代码 Agent 生成的往往是「一次性脚本」而非可持续编辑的生产级数据流水线——作者将此称为 NL2Pipeline Gap(自然语言到流水线之间…
NemoClaw for LangChain Deep Agents Blueprint(简称 NemoClaw)是 LangChain 与 NVIDIA 联合发布的企业级 Agent 参考架构,发布时间为 2026 年 7 月 8 日(PRNewswire)。 该 Blueprint 不是一款独立产品,而是把三层开源组件打包成一套可落地、可自托管的完整 A…
代表攻略
LlamaParse Retrieval Harness:面向 Agent 的大规模文档遍历框架 · 干货攻略
LlamaParse Retrieval Harness 是 LlamaIndex(LlamaParse 平台)在 2026 年 6 月 29 日正式上线的一套面向 Agent 的文档遍历工具集,被定位为"2026 版 RAG"。它不再将文档检索视为一次性的语义搜索,而是把整个文档语料库暴露为一组类文件系统工具,让 Agent 能在单次推理循环内自由交替调用…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
run-llama/llama_index
Stars 51,547
代表
run-llama/llama_index
Stars 51,547
仓库: 无(arXiv 论文,Microsoft Research,未开源代码) ECHO(Environment Crossentropy Hybrid Objective)是微软研究院提出的一种终端 Agent 强化学习混合训练目标,发表于 arXiv:2605.24517(2026 年 5 月 23 日)。论文作者:Vaishnavi Shrivast…
Science Context Protocol(SCP)是一个开源协议标准,由上海人工智能实验室(Yankai Jiang 等)提出,发表在 arXiv(2512.24189),GitHub 仓库为 InternScience/scp。 它的核心目标:为 AI 科研 Agent 提供一个全球性的协议层,让工具、模型、数据集乃至实验仪器能够跨平台、跨机构互联…
Retrieval Harness 是 LlamaIndex 在 2026 年提出的一种面向 Agent 的持久化检索架构模式,其参考实现为 runllama/legalkb(法律文档知识库 Demo)。 区别于传统的单次向量搜索 RAG,Harness 将文档知识库包装成一组类文件系统 API 工具(retrieve / findFiles / readF…
2026 年 7 月 14 日上传至 arXiv 的一篇97 页大survey(arXiv:2607.13104),由 DAIR.AI 团队(Zhe Ren、Yimeng Chen 等)联合 Jürgen Schmidhuber 等人撰写。配套 GitHub 仓库 selfimprovingagent/awesomeSelfImprovingAgents 提…
Sakana AI 在 ICLR 2026 发表了一篇非常有意思的论文:让一个小模型学会当「指挥家」,而不是自己下场干活。 传统多智能体系统的做法是:人类预先写好流水线(planner → coder → verifier),然后让模型按这个固定流程走。问题在于:不同任务复杂度差异巨大——简单事实问答根本不需要 5 步 pipeline,而复杂编程题可能需要…
LibreCode 是一个完全本地运行的开源 AI 代码编辑器,基于 .NET 10 和 Avalonia UI 构建,声称是"Ollama 版 Cursor"。它不依赖 Electron、不跑 Web View,直接调用 Ollama 的本地大模型完成 AI 辅助编程,同时内置了一个专业级逆向工程工具包,支持 .NET 程序集、WebAssembly(.w…
ZenML 是一个面向 ML/AI 工程师的统一 AI 平台,核心价值主张是:一次编写,随处运行——用 Python 装饰器定义管道(pipelines)和步骤(steps),ZenML 自动处理容器化、追踪、部署和基础设施抽象,让你无需改动代码即可在本地、Kubernetes、云端之间切换。 ZenML 的定位介于实验追踪工具(MLflow、W&B)和完整…
Zerolang(zero)是 Vercel Labs 出品的实验性图原生(graphnative)编程语言,专为 AI Agent 设计。它的核心思路是:程序不是文本文件,而是一张语义图(semantic graph);Agent 通过查询图、提交经过检查的编辑来构建程序,而非直接操作原始文本。这样 Agent 的每次修改都会经过编译器的语义校验,从根本上…
DocsGPT 是一个开源的私有 AI 知识库与 Agent 构建平台,专注于让团队在完全私有化的环境下,对文档、代码库、内部知识进行 AI 问答与智能搜索。它融合了 RAG(检索增强生成)、多模型支持、Deep Research 模式和低代码 Agent 可视化构建器,适合企业和开发者私有部署。 核心定位:把 LangChain + RAG + Agent…
awesomecursorrules 是一个聚合 Cursor AI 编辑器 .mdc 规则文件的精选列表仓库。Cursor AI 是基于 AI 的代码编辑器(类似 VS Code + AI 助手),.cursor/rules/ 目录下的 .mdc 文件(Markdown + Cursor 扩展)定义项目级指令,告诉 Cursor AI 在特定项目、文件类型…
Agent Squad 是一个轻量级的多 Agent 编排框架,核心思路是把用户请求通过分类器(Classifier)路由到最合适的专属 Agent,同时维护跨 Agent 的对话上下文。它最早托管于 AWS Labs(awslabs/agentsquad,原名 multiagentorchestrator),现由 2FastLabs 维护。 框架有三个运行…
Coze Loop 是字节跳动 Coze(扣子)平台推出的AI Agent 全生命周期运营平台,最近将核心模块开源(Apache 2.0)。它解决的是 AI Agent 开发过程中"写 Prompt → 调试 → 评估效果 → 上线监控"这一整条链路的工程化问题。 开源版提供三大核心能力:Prompt 开发和调试(Playground)、自动化评估(Eval…
mcpuse 是一个全栈 MCP(Model Context Protocol)开发框架,帮助开发者快速构建 MCP Servers(工具服务器)和 MCP Apps(可交互的 AI 应用组件),同时提供 MCP Client / MCP Agent 客户端实现,内置 Web 版 Inspector 调试工具,并支持一键部署到 Manufact MCP Cl…
SurfSense 是开源的竞争情报(Competitive Intelligence)平台,专为 AI Agent 设计,可以理解为「面向 AI Agent 的 NotebookLM + 实时数据抓取」。 它让 AI Agent 能够实时抓取 Reddit、YouTube、Instagram、TikTok、Google Maps、Google Search…
Semble 是一个专为 AI Coding Agent 打造的代码搜索库,核心理念是:让 Agent 用自然语言提问,直接返回最相关的代码片段,全程不需要读取完整文件、不需要 grep,用比 grep+read 少约 98% 的 token 完成精准代码检索。 它本质上是一个本地代码语义索引工具:给 Semble 一个代码仓库,它会建立语义索引;Agent…
Coze Studio 是 Coze(扣子)AI Agent 开发平台的开源版本,源自已经服务过数万企业和数百万开发者的 Coze 商业平台。它将 Coze 的核心引擎完全开源,提供一站式的可视化开发工具,让用户可以从零开始创建、调试和部署 AI Agent、App 和 Workflow,门槛极低。 形象地说,它就是你自己的私有化 Coze/扣子平台——完整…
OpenSquilla 是一个token 高效的微内核 AI Agent 框架,核心理念是"同等预算,更多能力"(Same budget, more capability)。它用一个本地模型路由器(SquillaRouter)自动把每个对话回合路由到「最便宜且能胜任」的模型,同时配备持久记忆、分层沙箱、内置网页搜索和端侧 Embedding,所有入口(Web…
goose 是一个用 Rust 编写的开源 AI Agent,提供桌面应用、CLI 和 API 三种形态,支持 15+ LLM 提供商(Anthropic、OpenAI、Google、Ollama、OpenRouter、Azure、Bedrock 等),并通过 Model Context Protocol(MCP)连接 70+ 扩展。 它由 Linux Fo…
Graphiti 是由 Zep 团队开源的时序上下文图谱框架(Temporal Context Graph Engine),专为 AI Agent 设计。与传统的静态知识图谱或 RAG 方案不同,Graphiti 能持续追踪实体和关系随时间的变化——每条事实都有"有效期窗口",信息更新时旧事实被标记失效而非删除,保留完整历史。这使得 Graphiti 特别适…
Khoj 是一个开源的个人 AI 助手(自称 "Your AI second brain"),核心功能是让你用自己的文档(PDF、Markdown、Notion、Word、orgmode 等)创建一个可对话的知识库,同时支持连接任意 LLM(本地 Ollama 或云端 GPT/Claude/Gemini/DeepSeek)。它可以部署在个人电脑上完全离线运行…
agenticawesomeskills 是一个可安装的 AI 编程助手 Skill 库,收录 1,946+ 个可复用的 SKILL.md 工作流剧本,支持 Claude Code、Cursor、Codex CLI、Autohand Code、Gemini CLI、Antigravity、Kiro、OpenCode、GitHub Copilot 等主流 AI…
Claude HUD 是 Claude Code 的一个插件(Plugin),在终端底部状态栏实时显示当前会话的关键信息——包括上下文窗口使用量、Token 消耗速率、正在调用的工具、最近的 Agent 活动,以及 Todo 任务进度。 它的本质是:利用 Claude Code 原生的 statusline API,把 Claude Code 内部运行状态通…
Plano 是一个构建在 Envoy 代理之上的 AI 原生数据平面(Data Plane)与代理服务器,专为 Agentic Application(智能体应用)设计。它的核心思路是:把 Agent 开发中反复出现的"管道工作"(路由、编排、安全过滤、可观测性)从业务代码中抽离出来,放到一个独立进程里处理,让你专注在 Agent 的核心业务逻辑上。 简单说…