Sakana Fugu 是 Sakana AI 在 2026 年发布的多智能体编排系统,其核心是一个 7B 参数的 Conductor 模型。该模型不自己解题,而是像"管理者"一样动态决定: 调用哪些专家模型(worker pool 包含 GPT5.5、Gemini 3.1 Pro、Claude Opus 4.8 等) 每个 worker 分配什么任务 wo…
仓库攻略
137 篇 · 136 个项目 · jay · 评测基准
Sakana AI 在 ICLR 2026 发表了一篇非常有意思的论文:让一个小模型学会当「指挥家」,而不是自己下场干活。 传统多智能体系统的做法是:人类预先写好流水线(planner → coder → verifier),然后让模型按这个固定流程走。问题在于:不同任务复杂度差异巨大——简单事实问答根本不需要 5 步 pipeline,而复杂编程题可能需要…
ReG(Refined Graphbased RAG)是一套针对图增强检索(RAG on Knowledge Graph)的框架,核心思路是用 LLM 的反馈信号来训练更好的图检索器,同时将检索结果重组为逻辑连贯的证据链。 论文标题全称:WeaktoStrong GraphRAG: Aligning Weak Retrievers with Large La…
ThinkingCapQwen3.627B 是由 BottleCap AI 发布的推理效率优化微调模型,基于 Qwen 团队 2026 年 4 月开源的 Qwen3.627B(稠密 27B 参数多模态模型,支持思维链推理与非思维推理双模式)进行微调,核心目标是:在保持答案质量和风格完全不变的前提下,系统性削减推理时的"思考 Token"数量。 原帖分享者 @…
NapMem(Navigate over Pyramid Memory)是阿里巴巴 Qwen 团队与多所高校在 2026 年 7 月 7 日联合发布的论文提出的框架,核心思想是:把长期用户记忆从被动检索变成 Agent 可主动探索的结构化动作空间。 目前主流的记忆系统(如 Mem0、Zep、MemoryBank)都是被动 RAG 模式——检索组件从数据库捞取…
llmaction 是一个中文大模型技术博客式知识库,由独立作者维护,系统整理了大模型从训练到推理、从微调到部署的全链路技术内容。仓库以 Markdown 文件为主,通过 GitHub + 知乎/掘金文章链接提供深度教程,涵盖 LLM 预训练、SFT、RLHF、分布式训练、推理优化、量化、评测等几乎所有核心环节。适合想系统了解大模型工程实战的工程师和研究人员…
Coze Loop 是字节跳动 Coze(扣子)平台推出的AI Agent 全生命周期运营平台,最近将核心模块开源(Apache 2.0)。它解决的是 AI Agent 开发过程中"写 Prompt → 调试 → 评估效果 → 上线监控"这一整条链路的工程化问题。 开源版提供三大核心能力:Prompt 开发和调试(Playground)、自动化评估(Eval…
内容待复核
alebcay/awesome-shell · 上手攻略
awesomeshell 是 GitHub 上最权威的命令行工具精选列表,由 alebcay 维护,灵感来自 awesomephp。它将数百款优秀的命令行框架、工具库、指南和小玩意按类别组织起来,帮助 Shell 用户快速发现和筛选适合自己工作流的命令行利器。 截至 2026 年中,该仓库已积累约 37,000+ Stars,是命令行工具领域的标杆 Awes…
Semble 是一个专为 AI Coding Agent 打造的代码搜索库,核心理念是:让 Agent 用自然语言提问,直接返回最相关的代码片段,全程不需要读取完整文件、不需要 grep,用比 grep+read 少约 98% 的 token 完成精准代码检索。 它本质上是一个本地代码语义索引工具:给 Semble 一个代码仓库,它会建立语义索引;Agent…
NVIDIA/MegatronLM(Stars 17,034,周增 +35)是 NVIDIA 开源的大规模 Transformer 模型训练框架,包含两个核心组件: 通俗说:这是 NVIDIA 官方出品、经过生产级别验证的大模型训练基础设施,让你在数千块 GPU 上高效训练从 2B 到 462B 参数的模型。 uv pip install megatronc…
nanovllm 是一个从零实现的高效 vLLM 复刻项目,作者希望用约 1200 行干净可读的 Python 代码展示 vLLM 的核心原理。它不是 vLLM 的分支或包装,而是一个独立的精简实现,API 设计与 vLLM 保持高度兼容,同时内置了 Prefix Caching、Tensor Parallelism、Torch Compilation、CU…
LMCache 是一个KV Cache 管理中间件层,专为 LLM 推理场景设计。它的核心思路是把 GPU VRAM 中转瞬即逝的 KV Cache 变成可持久化、可复用、可监控的 AI 原生存储,从而显著降低 TTFT(Time To First Token,首 token 延迟),提升多轮对话和 Agentic Workload 的吞吐量。 典型工作场景…
Khoj 是一个开源的个人 AI 助手(自称 "Your AI second brain"),核心功能是让你用自己的文档(PDF、Markdown、Notion、Word、orgmode 等)创建一个可对话的知识库,同时支持连接任意 LLM(本地 Ollama 或云端 GPT/Claude/Gemini/DeepSeek)。它可以部署在个人电脑上完全离线运行…
agenticawesomeskills 是一个可安装的 AI 编程助手 Skill 库,收录 1,946+ 个可复用的 SKILL.md 工作流剧本,支持 Claude Code、Cursor、Codex CLI、Autohand Code、Gemini CLI、Antigravity、Kiro、OpenCode、GitHub Copilot 等主流 AI…
funNLP 是一个中文 NLP 工具与资源的大集合,由 NLP 从业者「fighting41love」整理维护。GitHub Stars 超过 81k,周增 +77(数据截至 20260713),最后提交 20240510。仓库并非一个独立的 Python 包,而是按主题分类的资源索引:每个条目都是一个真实的开源项目、数据集或工具,包含名称、描述和 Git…
内容待复核
aishwaryanr/awesome-generative-ai-guide · 上手攻略
这是一个由 Aishwarya Naresh Reganti(AWS ML 专家)维护的 Generative AI 综合性学习资源库。它的定位不是某个工具或框架的使用指南,而是一站式 AI 学习路径导航——涵盖大语言模型基础、提示工程、微调、RAG、Agent 开发、模型评估、面试准备、免费课程、论文精读,以及一系列成体系的学习路线图(Roadmap)。 …
Onyx 是 LLM 的应用层——一个功能丰富的开源 AI 平台,支持自托管。它让团队通过 RAG(检索增强生成)、深度研究、自定义 Agent、代码执行、Web 搜索、MCP 等高级能力,把 LLM 接入真实工作流。 核心定位:企业级 AI 平台(类 ChatGPT + RAG + Deep Research + Agents),可一键部署,适合需要数据隐…
llmengineertoolkit 是一个精心整理的 LLM 工具库清单,按功能分类收录了 120+ 个开源 Python 库,涵盖从模型训练、微调、推理、服务化,到 RAG、Agent、数据提取、评测、安全等完整流程的所有环节。 它的定位是"LLM 全栈工程师的工具箱目录"——不是教你某个库怎么用,而是告诉你做某件事有哪些成熟工具可以选择,让你在立项时快…
RAG_Techniques 是一个专注于 RetrievalAugmented Generation(检索增强生成) 高级技术的开源教程仓库,由 Nir Diamant 维护。目前收录 42+ 个可运行的 Jupyter Notebook,覆盖从基础 RAG 到最新前沿技术的完整知识体系,每个技术都配有详细原理解析、代码实现和论文引用。截至 2026 年 …
InkOS 是一个面向故事创作与多语言翻译的 AI Agent 系统(当前版本 1.7.0),应用于小说、剧本、互动影游、开放世界和 IP 内容创作。它由多个专业 Agent 协同完成创作,支持 Studio(网页可视化)、TUI(全屏终端)和 CLI 三种交互形态。 核心定位:让 AI Agent 真正理解创作意图,通过规划 → 写作 → 审稿 → 修订的…
MLflow 是全球规模最大的开源 AI 工程平台,服务于 agents、LLM 和传统 ML 模型的全生命周期。每月下载量超过 6000 万次,数千家企业将其用于生产级 AI 部署。 在 2026 年的 MLflow 3.x 版本中,它已演化为真正统一的平台,同时覆盖传统 ML、深度学习和生成式 AI 应用。核心四大能力: Prompt Registry(…
Graphify 是一个让 AI 编程助手(Claude Code、Cursor、Codex 等)把任意代码仓库转化为可查询知识图谱的工具。本质是一个 Claude Code / AI Coding Agent 的 /graphify 技能(Skill):输入 /graphify .,它便将项目代码、文档、图片、视频全部映射为一张节点边图谱,之后你可以用自然…
Memori 是面向 AI Agent 的记忆基础设施(Agentnative Memory Infrastructure)。它的核心定位是:解决 AI Agent「每次对话从零开始」的根本痛点——让 Agent 不仅记得「说过什么」,更记得「做过什么」,并能将执行过程中的决策、工具调用、结果都结构化地持久化,以便下次调用时精准召回。 与简单的向量数据库检索…
PDFMathTranslate(发布名 pdf2zh)是一个保留排版的 PDF 学术论文翻译工具,能将 PDF 文档完整翻译为双语格式(原文+译文对照)或纯译文,同时保留公式、图表、目录结构、注释等复杂元素不走形。 核心特点: 支持 Google、DeepL、OpenAI、Claude、Ollama、MiniMax 等多种翻译服务 提供 CLI、GUI、D…
browseruse 是让 AI Agent 操作浏览器的 Python 库——AI 描述任务,浏览器替你完成:点按钮、填表单、滚动页面、抓取内容。2026 年 7 月 Stars 104k+,Odysseys 排行榜第一(87.4% 平均准确率),领先 OpenAI、Anthropic、Google、Microsoft 的同类产品。 有两种使用方式:CLI…
Graphify 是一款面向 AI 编程助手的代码知识图谱生成工具(code knowledge graph generator)。它的核心思路是:将任意代码仓库(Python、JavaScript、SQL、R、Shell 等)的代码结构转换为一张可查询的知识图谱,替代传统的 grep/全文搜索方式,让 AI 助手可以直接"问问题"获取精准的代码上下文。 形…
Composio 是一个 AI Agent 工具集成平台,为 AI Agent 提供 1000+ 预认证工具包(Toolkit),覆盖 GitHub、Gmail、Slack、Linear、Notion、Salesforce 等主流 SaaS。它解决的问题是:让 Agent 不只是"聊天",而是真正"执行操作"——创建 issue、发送邮件、管理日历、查询数据…
Vercel AI SDK(ai)是 Vercel 官方推出的 TypeScript AI 开发工具包,旨在让开发者用最少的代码在 React、Next.js、Svelte、Vue、Angular、Node.js 等框架和运行时中构建 AI 应用和 Agent。核心定位是"AI 应用的统一 API 层"——换模型提供商只需改两行代码,无需重写业务逻辑。 当前…
Oumi 是一个开源的 LLM 全生命周期管理平台,覆盖从数据准备、微调训练、评估评测到部署上线的完整流程。它用统一 CLI(oumi)串联起 Transformers、TRL、vLLM、veRL 等主流训练推理库,让你用同一套配置在不同硬件规模(单卡 135M 到千卡 405B)下无缝切换。 支持 Gemma 4、Qwen3.5、Qwen3.6、GPTos…
MemPalace 是一个本地优先的 AI 记忆系统,核心卖点是:原文逐字存储(不摘要、不压缩)、可插拔向量后端、96.6% R@5(LongMemEval 基准)以及完全零 API 调用。数据永远留存在本机,通过语义搜索而非总结来召回历史上下文。 它的组织模型借用了"记忆宫殿"的隐喻: 官方文档: | PyPI:mempalace ⚠️ 防骗警告:MemP…