LlamaParse Retrieval Harness(发布于 2026 年 6 月 29 日)是 LlamaIndex 在 LlamaParse Index v2 中推出的一套面向 Agent 的文档检索工具集。它不再把文档库当成一个静态向量数据库让 Agent 做一次语义搜索,而是把整个索引暴露为一组类文件系统接口——Agent 可以主动 list、g…
仓库攻略
118 篇 · 117 个项目 · jay · RAG 检索增强
2026 年 7 月,Anthropic 将 Claude Code 的 system prompt 裁剪了 80%,用于最新一代 Claude 5 模型(Opus 5、Fable 5,又称 Mythos 系列)。结果:coding eval 无任何可测量的质量下滑。 这一举动揭示了 Claude 5 时代最重要的 prompt 认知反转:塞入大量示例、禁止…
koreanlawmcp 是一个基于韩国法制处(법제처)Open API 的 MCP(Model Context Protocol)服务器,同时附带 CLI 工具。它将韩国 42 个官方法律 API 压缩为 10 个核心工具,让 AI 助手(Claude Desktop、Cursor、Windsurf、Zed 等)能够实时查询、验证和分析韩国成文法和判例。 …
DataFlowHarness 是北京大学联合中关村 Academy 于 2026 年 7 月 18 日发布的一个代码 Agent 平台(技术报告 arXiv:2607.16617),核心解决一个实际问题:LLM 代码 Agent 生成的往往是「一次性脚本」而非可持续编辑的生产级数据流水线——作者将此称为 NL2Pipeline Gap(自然语言到流水线之间…
代表攻略
LlamaParse Retrieval Harness:面向 Agent 的大规模文档遍历框架 · 干货攻略
LlamaParse Retrieval Harness 是 LlamaIndex(LlamaParse 平台)在 2026 年 6 月 29 日正式上线的一套面向 Agent 的文档遍历工具集,被定位为"2026 版 RAG"。它不再将文档检索视为一次性的语义搜索,而是把整个文档语料库暴露为一组类文件系统工具,让 Agent 能在单次推理循环内自由交替调用…
同类项目 2展开比较
同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。
run-llama/llama_index
Stars 51,547
代表
run-llama/llama_index
Stars 51,547
这篇来自弗吉尼亚大学与 Google 的研究(arXiv:2602.13517,ICML 2026 录用)提出了一个核心问题:模型生成的 token 数量,真的能衡量它的推理努力吗? 答案是否定的。研究者发现,输出 token 数与准确率之间存在平均负相关(r = −0.544)——token 越多,反而可能越差。这被称为"过度思考"(overthinkin…
Inkling 是 Thinking Machines Lab(由前 OpenAI CTO Mira Murati 创办)于 2026 年 7 月 15 日发布的首个从零训练的开源权重混合专家模型。官方定位明确:不是最强通用模型,而是最适合拿来定制(finetuning)的开源基础模型。 核心规格(官方 HuggingFace 模型卡): | 指标 | 数值…
ParseBench 是 LlamaIndex 在 CVPR 2026 上发布的首个面向 AI Agent 的文档解析评测基准(arXiv:2604.08538,cs.CV)。 它的核心命题是:文档 OCR 不是"把 PDF 转成文字",而是必须保留足够的结构和语义,让 Agent 能可靠地自主决策。一旦表格列对齐错位、小数点丢失、删除线被静默丢弃,Agen…
Retrieval Harness 是 LlamaIndex 在 2026 年提出的一种面向 Agent 的持久化检索架构模式,其参考实现为 runllama/legalkb(法律文档知识库 Demo)。 区别于传统的单次向量搜索 RAG,Harness 将文档知识库包装成一组类文件系统 API 工具(retrieve / findFiles / readF…
GPT5.6 是 OpenAI 于 2026 年 7 月 9 日正式发布的第五代 GPT 主线模型,采用了与前代完全不同的三级档位 + 多档推理努力度矩阵: 三档(Tier) | 档位 | 定位 | 输入价格 ($/1M tokens) | 输出价格 ($/1M tokens) | ||||| | Sol | 前沿旗舰,对应此前不带后缀的 GPT5 | $5…
ReG(Refined Graphbased RAG)是一套针对图增强检索(RAG on Knowledge Graph)的框架,核心思路是用 LLM 的反馈信号来训练更好的图检索器,同时将检索结果重组为逻辑连贯的证据链。 论文标题全称:WeaktoStrong GraphRAG: Aligning Weak Retrievers with Large La…
LibreCode 是一个完全本地运行的开源 AI 代码编辑器,基于 .NET 10 和 Avalonia UI 构建,声称是"Ollama 版 Cursor"。它不依赖 Electron、不跑 Web View,直接调用 Ollama 的本地大模型完成 AI 辅助编程,同时内置了一个专业级逆向工程工具包,支持 .NET 程序集、WebAssembly(.w…
astridruntime/book 是 Unicity Astrid OS 的权威技术参考文档,同样基于 mdBook 构建。它是理解 Astrid 操作系统内部设计的完整手册,面向构建 Capsule(胶囊)或深入理解系统架构的开发者。 Astrid OS 是一个专为 AI Agent 设计的操作系统,它的核心设计哲学是:像操作系统对待进程一样对待 AI…
ZenML 是一个面向 ML/AI 工程师的统一 AI 平台,核心价值主张是:一次编写,随处运行——用 Python 装饰器定义管道(pipelines)和步骤(steps),ZenML 自动处理容器化、追踪、部署和基础设施抽象,让你无需改动代码即可在本地、Kubernetes、云端之间切换。 ZenML 的定位介于实验追踪工具(MLflow、W&B)和完整…
DocsGPT 是一个开源的私有 AI 知识库与 Agent 构建平台,专注于让团队在完全私有化的环境下,对文档、代码库、内部知识进行 AI 问答与智能搜索。它融合了 RAG(检索增强生成)、多模型支持、Deep Research 模式和低代码 Agent 可视化构建器,适合企业和开发者私有部署。 核心定位:把 LangChain + RAG + Agent…
ClearML 是一个开源的 ML/DL/GenAI 全栈开发与生产平台,涵盖实验管理(Experiment Manager)、数据管理与版本控制(HyperDatasets)、MLOps/LLMOps 编排(Agent + Orchestration)、模型服务(Model Serving)、报表与可视化(Reports)五大模块。用作者自己的话说:解决的…
NirDiamant/Prompt_Engineering 是由 AI 教育博主 Nir Diamant 维护的提示工程(Prompt Engineering)教程仓库,汇集了 22 种提示工程技术的 Jupyter Notebook 实战教程,从最基础的单轮/多轮提示模板到 ChainofThought、SelfConsistency、TreeofThou…
NapMem(Navigate over Pyramid Memory)是阿里巴巴 Qwen 团队与多所高校在 2026 年 7 月 7 日联合发布的论文提出的框架,核心思想是:把长期用户记忆从被动检索变成 Agent 可主动探索的结构化动作空间。 目前主流的记忆系统(如 Mem0、Zep、MemoryBank)都是被动 RAG 模式——检索组件从数据库捞取…
Agent Squad 是一个轻量级的多 Agent 编排框架,核心思路是把用户请求通过分类器(Classifier)路由到最合适的专属 Agent,同时维护跨 Agent 的对话上下文。它最早托管于 AWS Labs(awslabs/agentsquad,原名 multiagentorchestrator),现由 2FastLabs 维护。 框架有三个运行…
awesomejavascript 是由前端知名技术博主 sorrycc(子溯)维护的 JavaScript 库精选列表,目前 GitHub 星标 35,000+,是前端领域最有影响力的 awesome 系列清单之一。 它的本质是一份分类清晰、精选校对过的浏览器端 JavaScript 资源目录,覆盖从包管理器、模块加载器、构建工具,到框架、UI 组件、可视…
Nacos(Name and Configuration Service)是阿里巴巴开源的动态服务发现、配置管理和服务管理平台,专为云原生应用和微服务架构设计。它于 2018 年开源,2020 年成为 Apache 顶级项目(TLP),是 Java 微服务生态中最为流行的注册中心与配置中心之一。 Nacos 官方站: 核心四大能力: 1. 服务发现与健康检查…
cubestudio 是腾讯音乐(TME)开源的一站式云原生机器学习/深度学习/大模型 AI 平台,覆盖从数据标注、模型训练、任务编排、分布式推理到模型市场的 MLOps 全流程。 它是腾讯音乐内部多年沉淀的生产级平台首次对外开源,目标是为中大型团队提供一个开箱即用、功能全面的企业级 AI 基础设施,同时特别注重对国产硬件(昇腾 NPU)和国产软件生态的支持…
SurfSense 是开源的竞争情报(Competitive Intelligence)平台,专为 AI Agent 设计,可以理解为「面向 AI Agent 的 NotebookLM + 实时数据抓取」。 它让 AI Agent 能够实时抓取 Reddit、YouTube、Instagram、TikTok、Google Maps、Google Search…
zoterogpt 是一个 Zotero 文献管理器的 AI 助手插件,让研究者在阅读 PDF 文献时直接用 GPT(gpt3.5turbo / gpt4)提问、摘要、搜索相关文献,所有交互都以内嵌弹窗形式在 Zotero 内完成,无需切换到 ChatGPT 或其他工具。 核心作者是 MuiseDestiny,基于 zoteroplugintemplate …
Semble 是一个专为 AI Coding Agent 打造的代码搜索库,核心理念是:让 Agent 用自然语言提问,直接返回最相关的代码片段,全程不需要读取完整文件、不需要 grep,用比 grep+read 少约 98% 的 token 完成精准代码检索。 它本质上是一个本地代码语义索引工具:给 Semble 一个代码仓库,它会建立语义索引;Agent…
DataJuicer(简称 DJ)是一个为 foundation model 时代打造的数据操作系统,专注于将混乱的原始数据转化为 AI 可用的精炼数据。它把数据处理看成是可组合的基础设施,提供模块化的构建块来完成清洗、合成和分析,覆盖 AI 全生命周期的数据处理需求。 用大白话说:它是一个超大型数据处理工具箱,内置 200+ 算子(Operator),可以…
Coze Studio 是 Coze(扣子)AI Agent 开发平台的开源版本,源自已经服务过数万企业和数百万开发者的 Coze 商业平台。它将 Coze 的核心引擎完全开源,提供一站式的可视化开发工具,让用户可以从零开始创建、调试和部署 AI Agent、App 和 Workflow,门槛极低。 形象地说,它就是你自己的私有化 Coze/扣子平台——完整…
kuchin/awesomecto(Stars 35,175,周增 +28)是一个精选的 CTO / VP R&D 资源列表,由 Dima Kuchin(一位真实的 CTO)维护,专门面向初创公司和高速增长企业。仓库名虽然叫 awesomecto,但实际内容覆盖从技术管理者(CTO、VP Engineering)到初创公司运营的完整知识图谱,不只是给 CTO…
Graphiti 是由 Zep 团队开源的时序上下文图谱框架(Temporal Context Graph Engine),专为 AI Agent 设计。与传统的静态知识图谱或 RAG 方案不同,Graphiti 能持续追踪实体和关系随时间的变化——每条事实都有"有效期窗口",信息更新时旧事实被标记失效而非删除,保留完整历史。这使得 Graphiti 特别适…
HappyLLM 是 Datawhale 团队推出的系统性大模型学习教程,定位介于"科普"和"科研"之间,目标是授之以鱼,更授之以渔。它从 NLP 基本研究方法讲起,沿着 LLM 的思路和原理逐层深入,最终带领读者用 PyTorch 从零实现一个 LLaMA2 模型,并完成预训练、有监督微调(SFT)和 LoRA/QLoRA 高效微调的全流程。 与其姐妹项目…