Guides · organized/guides

仓库攻略

137 篇 · 136 个项目 · jay · 评测基准

Sakana Fugu:用 RL Conductor 调度多模型军团 · 干货攻略
Sakana Fugu 是 Sakana AI 在 2026 年发布的多智能体编排系统,其核心是一个 7B 参数的 Conductor 模型。该模型不自己解题,而是像"管理者"一样动态决定: 调用哪些专家模型(worker pool 包含 GPT5.5、Gemini 3.1 Pro、Claude Opus 4.8 等) 每个 worker 分配什么任务 wo…
SakanaAI/fugu Jay 2026-07-18
Learning to Orchestrate Agents in Natural Language with the Conductor · 干货攻略
Sakana AI 在 ICLR 2026 发表了一篇非常有意思的论文:让一个小模型学会当「指挥家」,而不是自己下场干活。 传统多智能体系统的做法是:人类预先写好流水线(planner → coder → verifier),然后让模型按这个固定流程走。问题在于:不同任务复杂度差异巨大——简单事实问答根本不需要 5 步 pipeline,而复杂编程题可能需要…
Agent 智能体 Jay 2026-07-17
Weak-to-Strong GraphRAG:用 LLM 反馈对齐弱检索器 · 干货攻略
ReG(Refined Graphbased RAG)是一套针对图增强检索(RAG on Knowledge Graph)的框架,核心思路是用 LLM 的反馈信号来训练更好的图检索器,同时将检索结果重组为逻辑连贯的证据链。 论文标题全称:WeaktoStrong GraphRAG: Aligning Weak Retrievers with Large La…
RAG 检索增强 无(arXiv:2506.22518,暂无官方代码仓库) Jay 2026-07-16
ThinkingCap-Qwen3.6-27B:推理 Token 减半、精度不降的微调攻略 · 干货攻略
ThinkingCapQwen3.627B 是由 BottleCap AI 发布的推理效率优化微调模型,基于 Qwen 团队 2026 年 4 月开源的 Qwen3.627B(稠密 27B 参数多模态模型,支持思维链推理与非思维推理双模式)进行微调,核心目标是:在保持答案质量和风格完全不变的前提下,系统性削减推理时的"思考 Token"数量。 原帖分享者 @…
bottleapai/ThinkingCap-Qwen3.6-27B Jay 2026-07-15
NapMem:将记忆变为结构化动作空间 · 干货攻略
NapMem(Navigate over Pyramid Memory)是阿里巴巴 Qwen 团队与多所高校在 2026 年 7 月 7 日联合发布的论文提出的框架,核心思想是:把长期用户记忆从被动检索变成 Agent 可主动探索的结构化动作空间。 目前主流的记忆系统(如 Mem0、Zep、MemoryBank)都是被动 RAG 模式——检索组件从数据库捞取…
Jay 2026-07-14
liguodongiot/llm-action · 上手攻略
llmaction 是一个中文大模型技术博客式知识库,由独立作者维护,系统整理了大模型从训练到推理、从微调到部署的全链路技术内容。仓库以 Markdown 文件为主,通过 GitHub + 知乎/掘金文章链接提供深度教程,涵盖 LLM 预训练、SFT、RLHF、分布式训练、推理优化、量化、评测等几乎所有核心环节。适合想系统了解大模型工程实战的工程师和研究人员…
LLM 基础设施 liguodongiot/llm-action Stars 24,886 Jay 2026-07-14
coze-dev/coze-loop · 上手攻略
Coze Loop 是字节跳动 Coze(扣子)平台推出的AI Agent 全生命周期运营平台,最近将核心模块开源(Apache 2.0)。它解决的是 AI Agent 开发过程中"写 Prompt → 调试 → 评估效果 → 上线监控"这一整条链路的工程化问题。 开源版提供三大核心能力:Prompt 开发和调试(Playground)、自动化评估(Eval…
Agent 智能体 coze-dev/coze-loop Stars 5,685 Jay 2026-07-14
内容待复核
alebcay/awesome-shell · 上手攻略
awesomeshell 是 GitHub 上最权威的命令行工具精选列表,由 alebcay 维护,灵感来自 awesomephp。它将数百款优秀的命令行框架、工具库、指南和小玩意按类别组织起来,帮助 Shell 用户快速发现和筛选适合自己工作流的命令行利器。 截至 2026 年中,该仓库已积累约 37,000+ Stars,是命令行工具领域的标杆 Awes…
工程化 alebcay/awesome-shell Stars 37,428 Jay 2026-07-14
MinishLab/semble · 上手攻略
Semble 是一个专为 AI Coding Agent 打造的代码搜索库,核心理念是:让 Agent 用自然语言提问,直接返回最相关的代码片段,全程不需要读取完整文件、不需要 grep,用比 grep+read 少约 98% 的 token 完成精准代码检索。 它本质上是一个本地代码语义索引工具:给 Semble 一个代码仓库,它会建立语义索引;Agent…
Agent 智能体 MinishLab/semble Stars 5,870 Jay 2026-07-14
NVIDIA/Megatron-LM · 上手攻略
NVIDIA/MegatronLM(Stars 17,034,周增 +35)是 NVIDIA 开源的大规模 Transformer 模型训练框架,包含两个核心组件: 通俗说:这是 NVIDIA 官方出品、经过生产级别验证的大模型训练基础设施,让你在数千块 GPU 上高效训练从 2B 到 462B 参数的模型。 uv pip install megatronc…
工程化 NVIDIA/Megatron-LM Stars 17,614 Jay 2026-07-13
GeeeekExplorer/nano-vllm · 上手攻略
nanovllm 是一个从零实现的高效 vLLM 复刻项目,作者希望用约 1200 行干净可读的 Python 代码展示 vLLM 的核心原理。它不是 vLLM 的分支或包装,而是一个独立的精简实现,API 设计与 vLLM 保持高度兼容,同时内置了 Prefix Caching、Tensor Parallelism、Torch Compilation、CU…
LLM 基础设施 GeeeekExplorer/nano-vllm Stars 14,623 Jay 2026-07-13
lmcache/lmcache · 上手攻略
LMCache 是一个KV Cache 管理中间件层,专为 LLM 推理场景设计。它的核心思路是把 GPU VRAM 中转瞬即逝的 KV Cache 变成可持久化、可复用、可监控的 AI 原生存储,从而显著降低 TTFT(Time To First Token,首 token 延迟),提升多轮对话和 Agentic Workload 的吞吐量。 典型工作场景…
LLM 基础设施 lmcache/lmcache Jay 2026-07-13
khoj-ai/khoj · 上手攻略
Khoj 是一个开源的个人 AI 助手(自称 "Your AI second brain"),核心功能是让你用自己的文档(PDF、Markdown、Notion、Word、orgmode 等)创建一个可对话的知识库,同时支持连接任意 LLM(本地 Ollama 或云端 GPT/Claude/Gemini/DeepSeek)。它可以部署在个人电脑上完全离线运行…
Agent 智能体 khoj-ai/khoj Stars 36,441 Jay 2026-07-13
sickn33/agentic-awesome-skills · 上手攻略
agenticawesomeskills 是一个可安装的 AI 编程助手 Skill 库,收录 1,946+ 个可复用的 SKILL.md 工作流剧本,支持 Claude Code、Cursor、Codex CLI、Autohand Code、Gemini CLI、Antigravity、Kiro、OpenCode、GitHub Copilot 等主流 AI…
Agent 智能体 sickn33/agentic-awesome-skills Stars 45,322 Jay 2026-07-13
fighting41love/funNLP · 上手攻略
funNLP 是一个中文 NLP 工具与资源的大集合,由 NLP 从业者「fighting41love」整理维护。GitHub Stars 超过 81k,周增 +77(数据截至 20260713),最后提交 20240510。仓库并非一个独立的 Python 包,而是按主题分类的资源索引:每个条目都是一个真实的开源项目、数据集或工具,包含名称、描述和 Git…
评测基准 fighting41love/funNLP Stars 82,399 Jay 2026-07-13
内容待复核
aishwaryanr/awesome-generative-ai-guide · 上手攻略
这是一个由 Aishwarya Naresh Reganti(AWS ML 专家)维护的 Generative AI 综合性学习资源库。它的定位不是某个工具或框架的使用指南,而是一站式 AI 学习路径导航——涵盖大语言模型基础、提示工程、微调、RAG、Agent 开发、模型评估、面试准备、免费课程、论文精读,以及一系列成体系的学习路线图(Roadmap)。 …
工程化 aishwaryanr/awesome-generative-ai-guide Stars 28,710 Jay 2026-07-13
onyx-dot-app/onyx · 上手攻略
Onyx 是 LLM 的应用层——一个功能丰富的开源 AI 平台,支持自托管。它让团队通过 RAG(检索增强生成)、深度研究、自定义 Agent、代码执行、Web 搜索、MCP 等高级能力,把 LLM 接入真实工作流。 核心定位:企业级 AI 平台(类 ChatGPT + RAG + Deep Research + Agents),可一键部署,适合需要数据隐…
LLM 基础设施 onyx-dot-app/onyx Stars 31,688 Jay 2026-07-13
KalyanKS-NLP/llm-engineer-toolkit · 上手攻略
llmengineertoolkit 是一个精心整理的 LLM 工具库清单,按功能分类收录了 120+ 个开源 Python 库,涵盖从模型训练、微调、推理、服务化,到 RAG、Agent、数据提取、评测、安全等完整流程的所有环节。 它的定位是"LLM 全栈工程师的工具箱目录"——不是教你某个库怎么用,而是告诉你做某件事有哪些成熟工具可以选择,让你在立项时快…
工程化 KalyanKS-NLP/llm-engineer-toolkit Stars 10,722 Jay 2026-07-12
NirDiamant/RAG_Techniques · 上手攻略
RAG_Techniques 是一个专注于 RetrievalAugmented Generation(检索增强生成) 高级技术的开源教程仓库,由 Nir Diamant 维护。目前收录 42+ 个可运行的 Jupyter Notebook,覆盖从基础 RAG 到最新前沿技术的完整知识体系,每个技术都配有详细原理解析、代码实现和论文引用。截至 2026 年 …
RAG 检索增强 NirDiamant/RAG_Techniques Stars 29,013 Jay 2026-07-12
Narcooo/inkos · 上手攻略
InkOS 是一个面向故事创作与多语言翻译的 AI Agent 系统(当前版本 1.7.0),应用于小说、剧本、互动影游、开放世界和 IP 内容创作。它由多个专业 Agent 协同完成创作,支持 Studio(网页可视化)、TUI(全屏终端)和 CLI 三种交互形态。 核心定位:让 AI Agent 真正理解创作意图,通过规划 → 写作 → 审稿 → 修订的…
Agent 智能体 Narcooo/inkos Stars 8,889 Jay 2026-07-12
mlflow/mlflow · 上手攻略
MLflow 是全球规模最大的开源 AI 工程平台,服务于 agents、LLM 和传统 ML 模型的全生命周期。每月下载量超过 6000 万次,数千家企业将其用于生产级 AI 部署。 在 2026 年的 MLflow 3.x 版本中,它已演化为真正统一的平台,同时覆盖传统 ML、深度学习和生成式 AI 应用。核心四大能力: Prompt Registry(…
Agent 智能体 mlflow/mlflow Stars 27,456 Jay 2026-07-12
Graphify-Labs/graphify · 上手攻略
Graphify 是一个让 AI 编程助手(Claude Code、Cursor、Codex 等)把任意代码仓库转化为可查询知识图谱的工具。本质是一个 Claude Code / AI Coding Agent 的 /graphify 技能(Skill):输入 /graphify .,它便将项目代码、文档、图片、视频全部映射为一张节点边图谱,之后你可以用自然…
数据与向量库 Graphify-Labs/graphify Stars 105,053 Jay 2026-07-12
MemoriLabs/Memori · 上手攻略
Memori 是面向 AI Agent 的记忆基础设施(Agentnative Memory Infrastructure)。它的核心定位是:解决 AI Agent「每次对话从零开始」的根本痛点——让 Agent 不仅记得「说过什么」,更记得「做过什么」,并能将执行过程中的决策、工具调用、结果都结构化地持久化,以便下次调用时精准召回。 与简单的向量数据库检索…
Agent 智能体 MemoriLabs/Memori Stars 15,680 Jay 2026-07-12
PDFMathTranslate/PDFMathTranslate · 上手攻略
PDFMathTranslate(发布名 pdf2zh)是一个保留排版的 PDF 学术论文翻译工具,能将 PDF 文档完整翻译为双语格式(原文+译文对照)或纯译文,同时保留公式、图表、目录结构、注释等复杂元素不走形。 核心特点: 支持 Google、DeepL、OpenAI、Claude、Ollama、MiniMax 等多种翻译服务 提供 CLI、GUI、D…
Agent 智能体 PDFMathTranslate/PDFMathTranslate Stars 36,345 Jay 2026-07-12
browser-use/browser-use · 上手攻略
browseruse 是让 AI Agent 操作浏览器的 Python 库——AI 描述任务,浏览器替你完成:点按钮、填表单、滚动页面、抓取内容。2026 年 7 月 Stars 104k+,Odysseys 排行榜第一(87.4% 平均准确率),领先 OpenAI、Anthropic、Google、Microsoft 的同类产品。 有两种使用方式:CLI…
Agent 智能体 browser-use/browser-use Stars 109,104 Jay 2026-07-11
safishamsi/graphify · 上手攻略
Graphify 是一款面向 AI 编程助手的代码知识图谱生成工具(code knowledge graph generator)。它的核心思路是:将任意代码仓库(Python、JavaScript、SQL、R、Shell 等)的代码结构转换为一张可查询的知识图谱,替代传统的 grep/全文搜索方式,让 AI 助手可以直接"问问题"获取精准的代码上下文。 形…
RAG 检索增强 safishamsi/graphify(现重定向至 Graphify-Labs/graphify) Jay 2026-07-11
ComposioHQ/composio · 上手攻略
Composio 是一个 AI Agent 工具集成平台,为 AI Agent 提供 1000+ 预认证工具包(Toolkit),覆盖 GitHub、Gmail、Slack、Linear、Notion、Salesforce 等主流 SaaS。它解决的问题是:让 Agent 不只是"聊天",而是真正"执行操作"——创建 issue、发送邮件、管理日历、查询数据…
Agent 智能体 ComposioHQ/composio Stars 29,622 Jay 2026-07-10
vercel/ai · 上手攻略
Vercel AI SDK(ai)是 Vercel 官方推出的 TypeScript AI 开发工具包,旨在让开发者用最少的代码在 React、Next.js、Svelte、Vue、Angular、Node.js 等框架和运行时中构建 AI 应用和 Agent。核心定位是"AI 应用的统一 API 层"——换模型提供商只需改两行代码,无需重写业务逻辑。 当前…
Agent 智能体 vercel/ai Stars 26,121 Jay 2026-07-10
oumi-ai/oumi · 上手攻略
Oumi 是一个开源的 LLM 全生命周期管理平台,覆盖从数据准备、微调训练、评估评测到部署上线的完整流程。它用统一 CLI(oumi)串联起 Transformers、TRL、vLLM、veRL 等主流训练推理库,让你用同一套配置在不同硬件规模(单卡 135M 到千卡 405B)下无缝切换。 支持 Gemma 4、Qwen3.5、Qwen3.6、GPTos…
多模态 oumi-ai/oumi Stars 9,369 Jay 2026-07-10
MemPalace/mempalace · 上手攻略
MemPalace 是一个本地优先的 AI 记忆系统,核心卖点是:原文逐字存储(不摘要、不压缩)、可插拔向量后端、96.6% R@5(LongMemEval 基准)以及完全零 API 调用。数据永远留存在本机,通过语义搜索而非总结来召回历史上下文。 它的组织模型借用了"记忆宫殿"的隐喻: 官方文档: | PyPI:mempalace ⚠️ 防骗警告:MemP…
评测基准 MemPalace/mempalace Stars 58,289 Jay 2026-07-10