Guides · organized/guides

仓库攻略

308 篇 · 307 个项目 · 评测基准

Avijit07x/claude-db · 上手攻略
claudedb 为 Claude Code 提供持久化记忆层,解决每次新会话都要重新解释代码库背景的痛点。它在本地记录你与 Claude 的对话历史、代码理解结论和项目决策,新会话时自动注入上下文,Claude 无需再靠"考古式 grep"自行推断。 核心思路:capture(记录)+ recall(回填)+ code graph(代码图),三轨并行运作。…
数据与向量库 Avijit07x/claude-db Stars 177 Tom 2026-08-22
coding-parrot/pothole-reporter · 上手攻略
potholereporter 是一个纯客户端 Android 应用,用 AI 视觉检测班加罗尔(Bengaluru)道路坑洞,自动关联公共采购记录找到负责官员和承包商,生成一份可编辑的投诉邮件草稿,由你审核后手动发送。 核心特点:没有服务端、不需要账号、不自动发邮件——一切都在本地完成,你掌控每一步。App 扫描约 2,900 份政府合同记录用于关联,检测…
Agent 智能体 coding-parrot/pothole-reporter Stars 116 Tom 2026-08-21
hymie122/RAG-Survey · 上手攻略
RAGSurvey 是一个按体系分类的 RAG 论文Awesome 列表,对应论文 RetrievalAugmented Generation for AIGenerated Content: A Survey(arXiv:2402.19473,2024 年 2 月,北大/北大深圳研究生院团队)。仓库按该论文提出的三层分类法,对 RAG 领域论文进行结构化整…
RAG 检索增强 hymie122/RAG-Survey Stars 1,790 Jay 2026-08-21
Gemini 3.7 Flash 长上下文实测表现 · 干货攻略
Gemini 3.7 Flash 是 Google 于 2026 年 8 月 13 日发布的工作负载模型,基于 Gemini 3.6 Flash 的算法改进版,主打编码和 Agent 场景。官方标称上下文窗口为 1,048,576 tokens(约 1M),最大输出 65,536 tokens(64K),支持文本、图像、音频、视频、PDF 多模态输入。 本攻…
Jay 2026-08-21
AntigmaLabs/ante · 上手攻略
Ante(读作「anti」)是 Antigma Labs 开源的一个自包含(selfcontained)终端编程智能体,核心定位是"Harness(工具架)优先,而非模型绑定"。作者观点鲜明:好用的 Agent 依赖的不只是模型,更是一套经过精细调校的执行框架(harness),而这套框架应该与模型解耦、可以自由替换。 一句话类比:Ante ≈ Claude…
Agent 智能体 AntigmaLabs/ante Stars 1,825 Tom 2026-08-21
TrueForge:开源 Agent Harness,75% 降本实战攻略 · 干货攻略
TrueForge 是 TrueFoundry 于 2026 年 8 月开源的 MIT 许可证 Agent Harness——运行在 LLM 周围的运行时层,把一个语言模型变成可真正跑在生产环境里的 Agent。它不挑模型、不绑云、不锁供应商,可以本地单进程(SQLite)运行,也可以 Docker Compose / Kubernetes 部署高可用集群。…
Agent 智能体 truefoundry/trueforge Jay 2026-08-21
onestardao/WFGY · 上手攻略
WFGY(万法归一 / WanFaGuiYi)是一个面向 AI 推理、RAG 与 Agent 工作流的开源协议与工具生态系统。它的核心主张是:在嵌入空间(embedding space)中构建语义场定律(semantic field laws),让 LLM 能够自我收敛推理路径,减少 RAG 漂移、幻觉和"幽灵匹配"问题。 当前公开的最新版本为 WFGY 5…
Agent 智能体 onestardao/WFGY Stars 1,778 Tom 2026-08-21
Ikalus1988/MisakaNet · 上手攻略
MisakaNet 是一个面向 AI 编程 Agent 的"失败记忆"知识库。它本身不是 Agent 框架、不是向量数据库、不是云服务,它的定位非常窄:让 Agent 在跑代码撞墙时,能搜到一条"别人已经踩过、且给出可复制修复路径"的经验。 仓库以纯 Git + Markdown + Python 标准库的形式存在(misakanetcore 是独立 PyP…
Agent 智能体 Ikalus1988/MisakaNet Stars 409 spark 2026-08-20
brontoguana/krasis · 上手攻略
Krasis 是一个混合 LLM 推理运行时,专注于在消费级显存受限的 NVIDIA GPU 上高效运行数百亿参数级别的 MoE(Mixture of Experts)大模型。它的核心设计目标是:让一张或两张普通游戏显卡(如 RTX 5090 32 GB、RTX PRO 6000 96 GB)就能跑得动原本需要 H100/A100 才能加载的千亿参数模型。 …
LLM 基础设施 brontoguana/krasis Stars 512 Jay 2026-08-20
0xsline/awesome-deepseek-harness · 上手攻略
DeepSeek Harness(DSH)是 DeepSeek 官方推出的 AI Agent 运行时,而 0xsline/awesomedeepseekharness 是一个精选生态导航库——它汇总了来自官方 dshexternal/hub 目录和 GitHub dshplugin 公开话题的所有插件、工具与基础设施,按功能分成 20 个分类,方便使用者快速…
评测基准 0xsline/awesome-deepseek-harness Stars 778 Jay 2026-08-20
Meta-Harness:端到端自动化优化 LLM 应用 Harness · 干货攻略
MetaHarness 是一个自动化 harness 工程的框架,来自斯坦福 IRIS Lab、Cornell 和 MIT,发表在 COLM 2026(arXiv:2603.28052)。 LLM 系统的性能不仅取决于模型权重,还取决于 harness——即围绕固定基础模型运行的代码,决定存储什么信息、检索什么信息、向模型展示什么。Harness 包括:系统…
stanford-iris-lab/meta-harness Jay 2026-08-20
yetone/cumora · 上手攻略
Cumora(cumora.ai)是一个AI Agent 团队协作平台,定位为"多 Agent team chat"——AI Agent 和人类共同出现在同一个通讯录、同一组对话里,Agent 不只是被动的问答机器,而是有身份(persona)、有记忆、能认领任务、相互协调而不打架的存在。 核心特点: ⚠️ 截至 202608,Cumora 处于 invit…
Agent 智能体 yetone/cumora Stars 2,488 Tom 2026-08-20
amitshekhariitbhu/ai-engineering-interview-questions · 上手攻略
一份持续更新的 AI 工程面试题库,由印度理工学院(IIT BHU)校友 Amit Shekhar 创建,配套其在线课程平台 Outcome School。仓库收录了 AI Engineer、Gen AI Engineer、LLM Engineer、Agentic AI Engineer、AI Platform Engineer、MLOps/LLMOps E…
工程化 amitshekhariitbhu/ai-engineering-interview-questions Stars 2,543 Tom 2026-08-20
HiLab-git/SSL4MIS · 上手攻略
SSL4MIS(Semi Supervised Learning for Medical Image Segmentation)是一个医学影像分割领域的半监督学习论文与代码汇总仓库,由 HiLab 团队维护。它不是一个可以直接跑起来的框架或工具,而是一个持续更新的文献 + 代码索引库——追踪这个领域从 2019 年至今几乎所有重要的论文及其官方实现。 每一项…
多模态 HiLab-git/SSL4MIS Stars 2,671 Tom 2026-08-20
ax-llm/ax · 上手攻略
Ax 是 TypeScript 版的 DSPy——一个为 LLM 构建的编程模型和训练框架,但用 TypeScript 实现,号称"几乎就是 TypeScript 的官方 DSPy"。它同一个语义核心还编译到 Python、Java、C++、Go 和 Rust,让你写一次 LLM 程序,跨多个语言生态运行。 核心特点: 签名驱动的结构化生成(typed st…
Agent 智能体 ax-llm/ax Stars 2,876 Tom 2026-08-20
代表攻略
LlamaExtract Agentic Plus:超大规模文档结构化提取实战指南 · 干货攻略
本攻略核验了所有数字与说法:准确率来自 ExtractBench 官方论文(arXiv:2607.29677)及 GitHub README;FTX 矩阵案例来自 Jerry Liu 原文;各 tier 定价来自 ExtractBench GitHub 页;与原帖说法一致处直接引用,与官方文档冲突处以官方为准并注明。 LlamaExtract Agentic…
Agent 智能体 run-llama/ExtractBench Jay 2026-08-19
同类项目 2展开比较

同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。

DiG-bench:纯文本科学发现能力评测基准 · 干货攻略
DiGbench(Discovery in Games)是 2026 年 8 月 12 日由 James C.R. Whittington(牛津大学)联合多位学者发布的新型 AI 评测基准,全称 Discovery in Games。 核心设计:70 个纯文本互动游戏,每个游戏内部有隐藏的「变换规则」,AI 智能体必须通过主动交互和实验来发现这些规则,然后将…
评测基准 discos-research/dig-bench Jay 2026-08-19
vespa-engine/vespa · 上手攻略
Vespa 是 Yahoo(现 Verizon Media)开源的企业级 AI 搜索与推荐平台,定位并非单纯的向量数据库,而是将向量检索、全文搜索、结构化数据查询、分布式模型推理全部整合在单一分布式引擎内。用户无需组合 Elasticsearch + Milvus + 推理服务等多家基础设施,一套 Vespa 就能完成从数据索引到结果排序的全部工作。全球生产…
数据与向量库 vespa-engine/vespa Stars 7,046 Tom 2026-08-19
OpenBMB/UltraRAG · 上手攻略
UltraRAG 是由清华大学 THUNLP、东北大学 NEUIR、OpenBMB、AI9stars 联合推出的低代码 RAG 开发框架,基于 MCP(Model Context Protocol)架构设计。它将 RAG 的核心组件(检索器 Retriever、生成器 Generation、语料处理 Corpus、评估 Evaluation)拆解为独立的 M…
Agent 智能体 OpenBMB/UltraRAG Stars 5,668 Tom 2026-08-19
genkit-ai/genkit · 上手攻略
Genkit 是 Google Firebase 团队开源的全栈 AI 应用开发框架,支持 JavaScript/TypeScript(生产就绪)、Go(生产就绪)、Python(Beta)、Dart(Preview)四种语言,可对接 Google Gemini、OpenAI、Anthropic、Ollama 等主流模型厂商。 核心理念:一套 API 走天下…
Agent 智能体 genkit-ai/genkit Stars 6,342 Tom 2026-08-19
index-tts/index-tts · 上手攻略
IndexTTS 是阿里巴巴 Index 团队开源的零样本(ZeroShot)语音克隆系统,用一段参考音频(10~30秒)即可复刻任意人的音色,生成对应文本的语音。当前稳定版为 IndexTTS2.5(2026年8月10日发布),支持中文、英语、日语、西班牙语、阿拉伯语五种语言,并在多语言跨音色任务上达到了开源 SOTA 水平。 核心能力: IndexTTS…
多模态 index-tts/index-tts Stars 22,384 Tom 2026-08-19
microsoft/agent-governance-toolkit · 上手攻略
Agent Governance Toolkit (AGT) 是微软在 20252026 年推出的开源 agent runtime governance 工具箱。它不重做 agent 框架,而是在 LangChain / CrewAI / OpenAI Agents / AutoGen / Google ADK 等任意框架外,套一层"policy enfor…
Agent 智能体 microsoft/agent-governance-toolkit Stars 5,892 spark 2026-08-18
open-mmlab/mmagic · 上手攻略
MMagic(Multimodal Advanced, Generative, and Intelligent Creation)是 OpenMMLab 体系下的 AIGC 工具箱,是 MMEditing 与 MMGeneration 合并后的统一继承者。它提供从底层 PyTorch 训练到高层 MMagicInferencer 的全套接口,覆盖图像 / 视…
多模态 open-mmlab/mmagic Stars 7,452 spark 2026-08-18
NVIDIA/NemoClaw · 上手攻略
NVIDIA NemoClaw 是一个 alpha 阶段的参考实现栈(reference stack),把"已经在市面上流通的 AI 智能体 CLI"包进 NVIDIA OpenShell 沙箱里跑。它的目标不是再造一个 agent,而是给"agent 已经能跑了、但我想让它跑得可控、可审计、可回滚"的场景,提供一整套安装、生命周期、网络策略、托管推理、快照…
Agent 智能体 NVIDIA/NemoClaw Stars 22,193 spark 2026-08-18
JaidedAI/EasyOCR · 上手攻略
EasyOCR 是一个用 PyTorch 开发的通用 OCR(光学字符识别)Python 库,开箱即用,支持 80+ 语言,涵盖 Latin、CJK(简繁体中文、日文、韩文)、Arabic、Devanagari、Cyrillic 等所有主流书写系统,同时处理自然场景文本和文档密集文本。 v1.7.2(2024 年 9 月)是当前最新正式版。自 2020 年起…
多模态 JaidedAI/EasyOCR Stars 29,861 Tom 2026-08-18
aipoch/open-science · 上手攻略
Open Science 是一个开源、localfirst、modelagnostic 的 AI 科研工作台,由专用的 AI Agent 驱动,帮助研究者完成从文献调研、假设生成到代码执行、数据分析、可视化、报告产出的全流程,所有结果都可追溯到产生它的完整活动记录。 它的核心定位是:把大模型 Agent 变成一个可信赖的科研搭档,而非一个聊天玩具。运行在研究…
Agent 智能体 aipoch/open-science Stars 3,127 Tom 2026-08-18
zylon-ai/private-gpt · 上手攻略
⚠️ 本稿数字与命令以 README 与 docs.privategpt.dev 抓取为准;命令中 qwen3.5:35b、mxbaiembedlarge 等具体模型名取自 README Quickstart,未经独立复现,请按你的硬件与显存重新核对。 PrivateGPT 是 Zylon 公司在 2023 年那个"本地聊天 PDF"爆款脚本基础上重写出来的…
[zylon-ai/private-gpt](https://github.com/zylon-ai/private-gpt) spark 2026-08-17