envoyproxy/aigateway 是 Envoy 生态下的 AI 网关项目,基于 Envoy Gateway 扩展,专门处理应用客户端到生成式 AI(GenAI)服务的流量。它的本质是一个 Kubernetes 原生的 LLM 流量管理平面,提供路由、认证、限流、弹性Failover等企业级能力。 Envoy 是 CNCF 旗下久经生产验证的代理,M…
仓库攻略
1019 篇 · 996 个项目 · Agent 智能体
anyllm 是 Mozilla AI 团队推出的 Python 库,目标是让你用同一套代码调用任何 LLM 提供商,无需改业务逻辑。 它的核心理念很清晰:LLM 提供商的 API 接口碎片化严重——OpenAI、Anthropic、Azure、Mistral、Ollama……各家参数名、响应格式、错误处理各有差异。anyllm 不重新造轮子,而是封装官方 …
ECHO(Environment Crossentropy Hybrid Objective)是一个让 CLI Agent 在 RL 训练过程中同时学习预测环境响应(terminal 输出)的混合目标函数,来自论文 arXiv:2605.24517(2026 年 5 月),由 Microsoft Research AI Frontiers 和 Prime I…
版本说明:仓库 README 中没有写死顶层版本号,文档站 inference.roboflow.com/using_inference/about 自称 "Inference 1.0",PyPI 上 inferencesdk 的最新轮转版本为 1.3.x(如 1.3.7)——下面的命令以当前 README 与 PyPI 通用写法为准,不写死小版本号,使用 …
llmd 是一个 CNCF Sandbox 级的开源项目,定位是在 Kubernetes 上跑"生产级"大模型分布式推理。它本身不是一个模型服务器(model server),而是架在 vLLM / SGLang]( 之上的编排与优化层——把推理服务拆成 prefill(首 token 阶段)/ decode(增量 token 阶段)、分层 KV cache…
一个长期被忽视的事实是:语言模型被训练来执行动作,但从未被显式训练来建模它们所处的环境。 标准 Agent 强化学习(如 GRPO)只在动作 token 上计算梯度,用稀疏的二元结果奖励(成功/失败)驱动学习。环境中返回的所有观测——stdout、stderr、文件内容、错误信息、工具响应——虽然在 rollout 中已经存在,却不参与训练,被白白丢弃。 工…
本攻略核验了 Raschka 原帖中每款模型的核心参数,所有数字均来自对应官方来源(HuggingFace 模型卡、官方博客、技术报告)。原帖描述与官方文档一致处已核对;存在差异处以官方为准并作注。 Sebastian Raschka(@rasbt)于 2026 年 7 月底更新了他维护的 LLM Architecture Gallery,一口气收录了 6 …
Kimi K3 是 Moonshot AI(MiniMax)推出的开源权重多模态 Agent 大模型,总参数量 2.8T(激活 104B),是全球首个开放的 3T 级开源模型。K3 基于两项自研架构:Kimi Delta Attention(KDA) 和 Attention Residuals(AttnRes),采用 MoE(MixtureofExperts…
Bento 是一个单文件 HTML 办公套件——目前以幻灯片(Slides)应用为核心,规划中还包括 Docs 和 Sheets,每个都打包成独立的 .bento.html 文件。它的核心思路是:文件本身就是软件。一份 .bento.html 文件包含完整的查看器、演示模式和编辑器,不需要安装、不需要注册、不需要联网——用任何现代浏览器打开即可运行。所有内容…
Better Agents 是由 LangWatch 团队开源的 CLI 工具 + 一套工程规范,旨在让 AI 编码助手(Claude Code、Cursor、Kilocode 等)成为真正的"Agent 专家",能按照行业最佳实践构建、测试和评估 AI Agent 项目。 它不替换已有的 Agent 框架(Agno、Mastra、LangGraph 等),…
UnityMCP(Unity Model Context Protocol)是一个将 Unity Editor 和 Runtime 接入 AI Agent(MCP 协议)的插件生态。装好后,AI Agent(如 Claude Code、Cursor、Copilot)能直接操作 Unity 场景、创建 GameObject、读写脚本、运行测试、截屏返回画面,实…
Agently(pip install agently)是一个 Python GenAI 应用开发框架,主打"让模型输出稳定可控、让 AI 服务像后端服务一样可观测、可恢复"。它的核心抽象是 AgentExecution:把一次推理涉及的 prompt、策略、Actions、Skill 绑定、process 流、TaskContext 证据、结果视图统一收口…
Paddler 是一款用 Rust 写的开源 LLM/VLM 推理负载均衡与服务平台。架构非常克制:只有两个组件——balancer(对外暴露 OpenAI 兼容推理接口、管理面和 Web 控制台)和 agent(真正跑推理,注册到 balancer 上即可上线)。底层直接用 llama.cpp 推理引擎(fork 版本,Paddler 自己实现了 slot…
Harness Anything 是一个开源的 AI Agent 控制中枢,通过 CLI 封装,将一系列闭源商业软件(WPS Office、Microsoft Office、Adobe 全家桶、Zotero)变成 AI Agent 可编程操控的目标。核心思路借鉴 CLIAnything 的 Harness 方法论,但后者只支持 GIMP、Blender 等开…
noaislop 是一个专注于「AI 味」检测和清除的开源工具,更准确地说是一套编辑规则和工作流。它的核心目标不是判断「这段文字是不是 AI 写的」,而是检测并清除文字中 20+ 种常见的 AI 写作模式(smell patterns),同时保留作者本人的声音、节奏和个性。 GitHub Stars 超过 2700,X(Twitter)帖子达到 611K 浏…
LlamaParse Retrieval Harness(发布于 2026 年 6 月 29 日)是 LlamaIndex 在 LlamaParse Index v2 中推出的一套面向 Agent 的文档检索工具集。它不再把文档库当成一个静态向量数据库让 Agent 做一次语义搜索,而是把整个索引暴露为一组类文件系统接口——Agent 可以主动 list、g…
LingBotWorld 2.0(又称 LingBotWorldInfinity)是蚂蚁集团具身智能团队 Robbyant 于 2026 年 7 月 9 日开源发布的交互式世界模型。它能根据用户输入的动作流(摄像头位姿 + 文本指令)逐帧生成视频,充当实时的可交互世界模拟器。 相比 1.0 版本分钟级稳定生成,2.0 实现了小时级连续输出,同时支持 720p…
huggingface.js 是 Hugging Face 官方维护的 JavaScript / TypeScript 工具套件,本身是个 monorepo,里面按职责拆分成了若干独立发布的 npm 包: @huggingface/hub:与 huggingface.co 交互——创建/删除仓库、上传/下载/列出文件、提交 commit。覆盖 Model /…
ABotWorld0 是阿里巴巴 AMAP 计算机视觉实验室(Alibaba AMAP CV Lab)发布的一款动作条件视频世界模型,目标是让单个消费级桌面 GPU 也能实现实时、长时、闭环的交互式世界推演——换句话说,把一块 RTX 5090 变成一个可以无限探索的虚拟世界模拟器。 核心技术规格(全部来自 GitHub README 与 arXiv 摘要)…
PocketFlow 是一个仅用 100 行 Python 代码实现的轻量级 LLM 框架,核心思想是将 LLM 应用建模为有向图(Graph)。框架本身零依赖(仅需 asyncio),安装包仅 56KB,却能表达 Agent、Workflow、RAG、MultiAgent 等常见设计模式。 作者的核心论点是:市面上的主流 LLM 框架(LangChain、…
FrontierCode 是 Cognition AI(Devin 的开发团队)于 2026 年 6 月 8 日发布的全新代码质量评测基准。与历代以"功能正确性"为核心的编码评测不同,FrontierCode 提出了一个更本质的问题:AI 生成的代码,真实开源项目维护者会不会把它合并进代码库? 这是业界首个以"合并可接受性"(mergeability)为核心…
img2threejs 是一个代码优先的图像→3D 重建工具。你给它一张参考图,它生成一段 TypeScript 代码,在浏览器里跑出一个 THREE.Group 工厂函数——所有几何体都由原始几何体(BoxGeometry、CylinderGeometry 等)、程序化着色器和生成式几何拼出来,没有 mesh 文件,没有 GLB 下载,产物天然是"代码"而…
OpenScience 是 Synthetic Sciences(YC W26 入选团队)出品的开源 AI 科研工作台。用户给定一个研究目标,它就以"能力型合作者"的方式走完完整研究闭环——读文献、提假设、写代码、跑实验、查数据库、写报告,全程在一个浏览器 Workspace 里完成。 它于 2026 年 7 月 5 日正式发布,定位是 Claude Sci…
Claude Code 动态工作流(Dynamic Workflows)是 Anthropic 于 2026 年 5 月 28 日(随 Opus 4.8 发布)推出的研究预览功能,核心解决一个长期难题:LLM Agent 的编排逻辑(即"谁在什么时机调用谁")本质上是硬编码的,无法动态适应任务规模。 动态工作流的解法是:让 Claude 自己写一个 Java…
MCP Router 是一个桌面端(Desktop)的 MCP 服务器统一管理应用,自定位为 "Unified MCP Server Management App / MCP Manager"。Model Context Protocol(MCP)是 Anthropic 推出的"让 LLM 调用外部工具/数据源"的开放协议,过去一年 MCP 服务器数量爆炸—…
envd(ɪnˈvdɪ,读作 "invideo")是 TensorChord 开源的一个面向 AI/ML 的容器化开发环境构建工具。它用一个声明式的 build.envd 文件描述你的训练/推理环境,然后用一个 envd up 命令把它打包成 OCI 兼容的镜像,并在本地(或远端 K8s 集群)跑起来。 它不是 Dockerfile 的替代品那种简单封装——…
Bionic GPT 是一个自托管(onpremise)的 ChatGPT 替代品,定位企业内部的私有生成式 AI 平台。它用 Rust 写了一个高性能 Web Server,把 RAG、文档解析、模型路由、鉴权、审计、可观测性这些通常要自己拼装的"内部 ChatGPT 必备件"打包成一个可直接落到 Kubernetes 上的完整栈。 它不是单一服务,而是按…
Tutti(音乐术语,意为"全体一起")是一个多 AI 智能体实时协作工作空间。 它解决的问题很直接:当你同时使用 Claude Code、Codex、Canvas 等多个 AI 智能体时,它们各自独立运作——你需要反复在不同窗口之间复制粘贴上下文、解释需求、协调交接。AI 理论上该替你干活,实际上你成了"智能体之间的传话筒"。 Tutti 的核心思路是:让…
一个多角色 Agent 团队研究工作流:用不同角色的 Agent(侦察员、批评员、总结员)组成研究小队,让它们像真实团队一样协作——各司其职、互相review、自动输出结论——而不是把问题扔给一个 LLM 然后祈祷它答对。 核心洞察来自 @omarsar0(Elvis,DAIR.AI 研究员):同一个 LLM 既写答案又评答案,本身就是盲点。解决方案不是换更…
21stdev/magicmcp 是 21st.dev 平台的 MCP(Model Context Protocol)服务器,专门为 AI 编程助手(Cursor、Windsurf、Claude Code、Cline、VS Code 等)提供 UI 组件生成能力。官方自称"like v0, but in your Cursor / Claude Code /…