claudedb 为 Claude Code 提供持久化记忆层,解决每次新会话都要重新解释代码库背景的痛点。它在本地记录你与 Claude 的对话历史、代码理解结论和项目决策,新会话时自动注入上下文,Claude 无需再靠"考古式 grep"自行推断。 核心思路:capture(记录)+ recall(回填)+ code graph(代码图),三轨并行运作。…
仓库攻略
308 篇 · 307 个项目 · 评测基准
Artificial Analysis Search Index(搜索 API 指数)是一个专门针对 AI Agent 搜索工具 的评测基准,由 AI 数据分析平台 Artificial Analysis(AA)于 2026 年 8 月 18 日正式发布。它的核心思路非常干净——用同一个 Agent 环境(模型、工具调用上限、评测任务完全相同),只替换底层的…
potholereporter 是一个纯客户端 Android 应用,用 AI 视觉检测班加罗尔(Bengaluru)道路坑洞,自动关联公共采购记录找到负责官员和承包商,生成一份可编辑的投诉邮件草稿,由你审核后手动发送。 核心特点:没有服务端、不需要账号、不自动发邮件——一切都在本地完成,你掌控每一步。App 扫描约 2,900 份政府合同记录用于关联,检测…
RAGSurvey 是一个按体系分类的 RAG 论文Awesome 列表,对应论文 RetrievalAugmented Generation for AIGenerated Content: A Survey(arXiv:2402.19473,2024 年 2 月,北大/北大深圳研究生院团队)。仓库按该论文提出的三层分类法,对 RAG 领域论文进行结构化整…
Gemini 3.7 Flash 是 Google 于 2026 年 8 月 13 日发布的工作负载模型,基于 Gemini 3.6 Flash 的算法改进版,主打编码和 Agent 场景。官方标称上下文窗口为 1,048,576 tokens(约 1M),最大输出 65,536 tokens(64K),支持文本、图像、音频、视频、PDF 多模态输入。 本攻…
Ante(读作「anti」)是 Antigma Labs 开源的一个自包含(selfcontained)终端编程智能体,核心定位是"Harness(工具架)优先,而非模型绑定"。作者观点鲜明:好用的 Agent 依赖的不只是模型,更是一套经过精细调校的执行框架(harness),而这套框架应该与模型解耦、可以自由替换。 一句话类比:Ante ≈ Claude…
TrueForge 是 TrueFoundry 于 2026 年 8 月开源的 MIT 许可证 Agent Harness——运行在 LLM 周围的运行时层,把一个语言模型变成可真正跑在生产环境里的 Agent。它不挑模型、不绑云、不锁供应商,可以本地单进程(SQLite)运行,也可以 Docker Compose / Kubernetes 部署高可用集群。…
WFGY(万法归一 / WanFaGuiYi)是一个面向 AI 推理、RAG 与 Agent 工作流的开源协议与工具生态系统。它的核心主张是:在嵌入空间(embedding space)中构建语义场定律(semantic field laws),让 LLM 能够自我收敛推理路径,减少 RAG 漂移、幻觉和"幽灵匹配"问题。 当前公开的最新版本为 WFGY 5…
MisakaNet 是一个面向 AI 编程 Agent 的"失败记忆"知识库。它本身不是 Agent 框架、不是向量数据库、不是云服务,它的定位非常窄:让 Agent 在跑代码撞墙时,能搜到一条"别人已经踩过、且给出可复制修复路径"的经验。 仓库以纯 Git + Markdown + Python 标准库的形式存在(misakanetcore 是独立 PyP…
Krasis 是一个混合 LLM 推理运行时,专注于在消费级显存受限的 NVIDIA GPU 上高效运行数百亿参数级别的 MoE(Mixture of Experts)大模型。它的核心设计目标是:让一张或两张普通游戏显卡(如 RTX 5090 32 GB、RTX PRO 6000 96 GB)就能跑得动原本需要 H100/A100 才能加载的千亿参数模型。 …
DeepSeek Harness(DSH)是 DeepSeek 官方推出的 AI Agent 运行时,而 0xsline/awesomedeepseekharness 是一个精选生态导航库——它汇总了来自官方 dshexternal/hub 目录和 GitHub dshplugin 公开话题的所有插件、工具与基础设施,按功能分成 20 个分类,方便使用者快速…
MetaHarness 是一个自动化 harness 工程的框架,来自斯坦福 IRIS Lab、Cornell 和 MIT,发表在 COLM 2026(arXiv:2603.28052)。 LLM 系统的性能不仅取决于模型权重,还取决于 harness——即围绕固定基础模型运行的代码,决定存储什么信息、检索什么信息、向模型展示什么。Harness 包括:系统…
Cumora(cumora.ai)是一个AI Agent 团队协作平台,定位为"多 Agent team chat"——AI Agent 和人类共同出现在同一个通讯录、同一组对话里,Agent 不只是被动的问答机器,而是有身份(persona)、有记忆、能认领任务、相互协调而不打架的存在。 核心特点: ⚠️ 截至 202608,Cumora 处于 invit…
一份持续更新的 AI 工程面试题库,由印度理工学院(IIT BHU)校友 Amit Shekhar 创建,配套其在线课程平台 Outcome School。仓库收录了 AI Engineer、Gen AI Engineer、LLM Engineer、Agentic AI Engineer、AI Platform Engineer、MLOps/LLMOps E…
SSL4MIS(Semi Supervised Learning for Medical Image Segmentation)是一个医学影像分割领域的半监督学习论文与代码汇总仓库,由 HiLab 团队维护。它不是一个可以直接跑起来的框架或工具,而是一个持续更新的文献 + 代码索引库——追踪这个领域从 2019 年至今几乎所有重要的论文及其官方实现。 每一项…
Ax 是 TypeScript 版的 DSPy——一个为 LLM 构建的编程模型和训练框架,但用 TypeScript 实现,号称"几乎就是 TypeScript 的官方 DSPy"。它同一个语义核心还编译到 Python、Java、C++、Go 和 Rust,让你写一次 LLM 程序,跨多个语言生态运行。 核心特点: 签名驱动的结构化生成(typed st…
Pigey(Physical Agency orchestrator)是一个闭环 VLM 调度层,驱动已有的冻结机器人技能(frozen skills),无需任何新数据或微调,即可在仿真和真实机器人上大幅提升推理密集型任务的成功率。 核心论文:"Addressing the Orchestration Gap in Generalist Robots via…
代表攻略
LlamaExtract Agentic Plus:超大规模文档结构化提取实战指南 · 干货攻略
本攻略核验了所有数字与说法:准确率来自 ExtractBench 官方论文(arXiv:2607.29677)及 GitHub README;FTX 矩阵案例来自 Jerry Liu 原文;各 tier 定价来自 ExtractBench GitHub 页;与原帖说法一致处直接引用,与官方文档冲突处以官方为准并注明。 LlamaExtract Agentic…
DiGbench(Discovery in Games)是 2026 年 8 月 12 日由 James C.R. Whittington(牛津大学)联合多位学者发布的新型 AI 评测基准,全称 Discovery in Games。 核心设计:70 个纯文本互动游戏,每个游戏内部有隐藏的「变换规则」,AI 智能体必须通过主动交互和实验来发现这些规则,然后将…
Vespa 是 Yahoo(现 Verizon Media)开源的企业级 AI 搜索与推荐平台,定位并非单纯的向量数据库,而是将向量检索、全文搜索、结构化数据查询、分布式模型推理全部整合在单一分布式引擎内。用户无需组合 Elasticsearch + Milvus + 推理服务等多家基础设施,一套 Vespa 就能完成从数据索引到结果排序的全部工作。全球生产…
UltraRAG 是由清华大学 THUNLP、东北大学 NEUIR、OpenBMB、AI9stars 联合推出的低代码 RAG 开发框架,基于 MCP(Model Context Protocol)架构设计。它将 RAG 的核心组件(检索器 Retriever、生成器 Generation、语料处理 Corpus、评估 Evaluation)拆解为独立的 M…
Genkit 是 Google Firebase 团队开源的全栈 AI 应用开发框架,支持 JavaScript/TypeScript(生产就绪)、Go(生产就绪)、Python(Beta)、Dart(Preview)四种语言,可对接 Google Gemini、OpenAI、Anthropic、Ollama 等主流模型厂商。 核心理念:一套 API 走天下…
IndexTTS 是阿里巴巴 Index 团队开源的零样本(ZeroShot)语音克隆系统,用一段参考音频(10~30秒)即可复刻任意人的音色,生成对应文本的语音。当前稳定版为 IndexTTS2.5(2026年8月10日发布),支持中文、英语、日语、西班牙语、阿拉伯语五种语言,并在多语言跨音色任务上达到了开源 SOTA 水平。 核心能力: IndexTTS…
Agent Governance Toolkit (AGT) 是微软在 20252026 年推出的开源 agent runtime governance 工具箱。它不重做 agent 框架,而是在 LangChain / CrewAI / OpenAI Agents / AutoGen / Google ADK 等任意框架外,套一层"policy enfor…
MMagic(Multimodal Advanced, Generative, and Intelligent Creation)是 OpenMMLab 体系下的 AIGC 工具箱,是 MMEditing 与 MMGeneration 合并后的统一继承者。它提供从底层 PyTorch 训练到高层 MMagicInferencer 的全套接口,覆盖图像 / 视…
NVIDIA NemoClaw 是一个 alpha 阶段的参考实现栈(reference stack),把"已经在市面上流通的 AI 智能体 CLI"包进 NVIDIA OpenShell 沙箱里跑。它的目标不是再造一个 agent,而是给"agent 已经能跑了、但我想让它跑得可控、可审计、可回滚"的场景,提供一整套安装、生命周期、网络策略、托管推理、快照…
EasyOCR 是一个用 PyTorch 开发的通用 OCR(光学字符识别)Python 库,开箱即用,支持 80+ 语言,涵盖 Latin、CJK(简繁体中文、日文、韩文)、Arabic、Devanagari、Cyrillic 等所有主流书写系统,同时处理自然场景文本和文档密集文本。 v1.7.2(2024 年 9 月)是当前最新正式版。自 2020 年起…
Open Science 是一个开源、localfirst、modelagnostic 的 AI 科研工作台,由专用的 AI Agent 驱动,帮助研究者完成从文献调研、假设生成到代码执行、数据分析、可视化、报告产出的全流程,所有结果都可追溯到产生它的完整活动记录。 它的核心定位是:把大模型 Agent 变成一个可信赖的科研搭档,而非一个聊天玩具。运行在研究…
Governance Decay(治理衰减)是一种新型智能体安全失效模式,由论文 Governance Decay: How Context Compaction Silently Erases Safety Constraints in LongHorizon LLM Agents(arXiv:2606.22528,2026 年 6 月)正式命名并系统量化…
⚠️ 本稿数字与命令以 README 与 docs.privategpt.dev 抓取为准;命令中 qwen3.5:35b、mxbaiembedlarge 等具体模型名取自 README Quickstart,未经独立复现,请按你的硬件与显存重新核对。 PrivateGPT 是 Zylon 公司在 2023 年那个"本地聊天 PDF"爆款脚本基础上重写出来的…