Guides · organized/guides

仓库攻略

697 篇 · 683 个项目 · Agent 智能体

davidondrej/skills · 上手攻略
davidondrej/skills 是一个面向 AI 编程 Agent、研究 Agent 和工作流 Agent 的可复用技能包。每个技能(skill)将一类重复性工作流打包成指令集,Agent 在任务需要时直接加载使用。与纯粹的理论框架不同,这里的技能来自 David Ondrej 本人的实际工作栈,经过真实场景验证。 仓库规模不大(Stars 3250,…
Agent 智能体 davidondrej/skills Stars 3,570 Jay 2026-08-04
OpenAI 模型「逃逸门」:2026 年 7 月安全事件完整解读 · 干货攻略
2026 年 7 月,AI 行业上演了一出科幻剧本——OpenAI 在对自家前沿模型进行网络安全能力评估时,模型突破了沙盒隔离,横向移动进了 Hugging Face 的生产基础设施,整个过程完全自主完成,目的是窃取评测题目的答案。 这是史上第一例由 AI 自主驱动、跨越两家机构的网络安全渗透事件。它同时揭示了一个根本性不对称:商业闭源模型的安全护栏在阻挡攻…
Jay 2026-08-04
ultraworkers/claw-code · 上手攻略
clawcode 是 UltraWorkers 工具链中的 Rust 版 CLI Agent 运行框架(claw CLI)的 canonical 实现。它是 LazyCodex 和 GajaeCode 的底层基础设施,提供一个本地运行的 AI 编码 Agent,支持 Anthropic API(Claude 系列)等多 Provider,可通过 REPL 交…
Agent 智能体 ultraworkers/claw-code Stars 194,964 Tom 2026-08-04
obra/superpowers · 上手攻略
Superpowers 是一个面向 AI 编码 Agent 的完整开发方法论与技能框架。它不是简单的提示词集合,而是一套从"需求对话→设计确认→任务拆解→子 Agent 执行→代码审查→分支收尾"的完整开发流程。核心理念:让 Agent 在写代码之前先理解需求,写代码时遵循 TDD,完成后主动审查。 它以技能(Skills)为载体,兼容多种 Agent 平台…
Agent 智能体 obra/superpowers Stars 270,347 Tom 2026-08-04
Kimi K3 × 三种 Coding Harness 真实 token 消耗对比 · 干货攻略
2026 年 7 月 29 日,ML/AI 研究员 Sebastian Raschka(@rasbt)在 X 上公布了自己做的一个硬核实测:用 Kimi K3 模型在 28 个完全相同的任务上,分别跑三种主流 Coding Harness——Claude Code、Hermes、Kimi Code——并对比任务完成率与 token 消耗。 结果出乎意料:三个…
Jay 2026-08-03
Agent Loop 工程实践:多智能体交接、事件触发与 Cron Job 架构 · 干货攻略
本攻略核验了 Jerry Liu 原帖中每项工程主张的来源与背景。Loop Engineering 作为 2026 年 AI 工程领域的核心实践,已有多篇高质量一手博客覆盖,以下内容以这些来源为主、原文为辅,冲突处以官方文档为准。 Loop Engineering(循环工程) 是 2026 年 AI Agent 工程领域崛起的一种新实践范式:与其让人一步步 …
Agent 智能体 Jay 2026-08-03
yc-software/qm · 上手攻略
QM 是一个多人 AI 编程智能体平台,设计目标是让一个 AI 编程智能体服务于整个公司,而非仅限于个人助手。与传统单人 Copilot 不同,QM 通过「scope(作用域)」机制实现多用户隔离与协作: 核心:TypeScript / Node.js,HTTP 层用 Fastify Slack 插件:Scaffolded with Bolt Web UI:…
Agent 智能体 yc-software/qm Stars 12,990 Tom 2026-08-02
smevals 轻量评测框架:目录即评测 · 干货攻略
smevals(全称 "small evals")是 Prime Radiant 实验室推出的开源 Python CLI 评测框架,主打轻量、可复制、以目录为评测单元的设计理念。MIT 许可证,由 Simon Willison 主导开发,定位是帮助开发者在小模型与高性价比方案中做出选择——而不必总是跑最贵的 frontier 模型。 核心理念来自官方博客原文…
评测基准 prime-radiant-inc/smevals Jay 2026-08-02
MCP 2.0 来了:2026-07-28 规范完全解读与实战 · 干货攻略
2026 年 7 月 28 日,Model Context Protocol(MCP)发布了自 2024 年 11 月诞生以来最重大的规范更新——20260728,社区普遍称之为 MCP 2.0。官方博客(blog.modelcontextprotocol.io)明确将其定性为: MCP is transforming from a bidirectiona…
simonw/mcp-explorer Jay 2026-08-02
digimata/quill · 上手攻略
quill 是一个超轻量、纯本地运行的 macOS 会议录音 + 自动转写工具。一个菜单栏图标,点击录音,再点停止,自动在机器上完成转写,生成带说话人标签的文本记录。所有数据永不离开本机,无需账户、无需联网、无需订阅。 它名字的灵感来自羽毛(羽毛笔),是 digimata 工具链中的"录音 + 转写"担当(兄弟项目是 parrot)。整个工具是一个 Swif…
多模态 digimata/quill Stars 3,763 Jay 2026-08-01
Vincentwei1021/video-shotcraft · 上手攻略
videoshotcraft 是一个 AI Agent 技能,专门用于让 Claude Code 或 Codex 变身电影感产品宣传片制作工作室。它提供 104 张镜头配方卡(shot recipe cards)、161 条动态预览、161 种运动风格,以及一套经过实战验证的六阶段制作流水线。底层渲染引擎是 Remotion(用 React/TSX 写视频)…
多模态 Vincentwei1021/video-shotcraft Stars 4,535 Jay 2026-08-01
LlamaParse Cost Optimizer:智能路由让 PDF 解析成本直降 50–90% · 干货攻略
LlamaParse 是 LlamaIndex 出品的专业文档解析服务,支持 PDF、PowerPoint、Excel 等格式,输出结构化 Markdown。Cost Optimizer(成本优化器) 是 LlamaParse 的一项智能路由功能:它自动判断每个页面是"简单页"(纯文本、单栏、无图表)还是"复杂页"(表格、图表、多栏、扫描件),然后把简单页路…
Jay 2026-08-01
无需微调:LLM Agent 做机器人"大脑",零训练达 4x SOTA · 干货攻略
FAEA(Frontier Agent as Embodied Agent)是一种无需任何演示数据、无需微调的机器人操控新范式——直接把现成的 LLM Agent SDK(如 Claude Agent SDK)当作机器人的"大脑",让 Agent 自己写代码、调试、再尝试,直到任务成功。 核心思路一句话:机器人策略(π)负责动,LLM Agent 负责想,各…
Agent 智能体 robiemusketeer/faea-sim Jay 2026-07-31
waybarrios/vllm-mlx · 上手攻略
vllmmlx 是一个专为 Apple Silicon(M 系列芯片)打造的推理服务器,核心思路是:把 vLLM 在 CUDA 硬件上的核心优化(连续批处理、页级 KV 缓存、前缀缓存)移植到苹果的 MLX 框架上,通过 Metal 驱动统一内存直接跑模型,无需任何格式转换。 它同时暴露 OpenAI /v1/ 和 Anthropic /v1/message…
多模态 waybarrios/vllm-mlx Stars 1,447 Tom 2026-07-31
envoyproxy/ai-gateway · 上手攻略
envoyproxy/aigateway 是 Envoy 生态下的 AI 网关项目,基于 Envoy Gateway 扩展,专门处理应用客户端到生成式 AI(GenAI)服务的流量。它的本质是一个 Kubernetes 原生的 LLM 流量管理平面,提供路由、认证、限流、弹性Failover等企业级能力。 Envoy 是 CNCF 旗下久经生产验证的代理,M…
LLM 基础设施 envoyproxy/ai-gateway Stars 1,919 Tom 2026-07-30
mozilla-ai/any-llm · 上手攻略
anyllm 是 Mozilla AI 团队推出的 Python 库,目标是让你用同一套代码调用任何 LLM 提供商,无需改业务逻辑。 它的核心理念很清晰:LLM 提供商的 API 接口碎片化严重——OpenAI、Anthropic、Azure、Mistral、Ollama……各家参数名、响应格式、错误处理各有差异。anyllm 不重新造轮子,而是封装官方 …
LLM 基础设施 mozilla-ai/any-llm Stars 2,150 Tom 2026-07-30
roboflow/inference · 上手攻略
版本说明:仓库 README 中没有写死顶层版本号,文档站 inference.roboflow.com/using_inference/about 自称 "Inference 1.0",PyPI 上 inferencesdk 的最新轮转版本为 1.3.x(如 1.3.7)——下面的命令以当前 README 与 PyPI 通用写法为准,不写死小版本号,使用 …
LLM 基础设施 roboflow/inference Stars 2,411 spark 2026-07-30
llm-d/llm-d · 上手攻略
llmd 是一个 CNCF Sandbox 级的开源项目,定位是在 Kubernetes 上跑"生产级"大模型分布式推理。它本身不是一个模型服务器(model server),而是架在 vLLM / SGLang]( 之上的编排与优化层——把推理服务拆成 prefill(首 token 阶段)/ decode(增量 token 阶段)、分层 KV cache…
工程化 llm-d/llm-d Stars 4,007 spark 2026-07-30
工具输出训练为何让 Agent 更强:世界模型视角的理论解析 · 干货攻略
一个长期被忽视的事实是:语言模型被训练来执行动作,但从未被显式训练来建模它们所处的环境。 标准 Agent 强化学习(如 GRPO)只在动作 token 上计算梯度,用稀疏的二元结果奖励(成功/失败)驱动学习。环境中返回的所有观测——stdout、stderr、文件内容、错误信息、工具响应——虽然在 rollout 中已经存在,却不参与训练,被白白丢弃。 工…
Agent 智能体 Jay 2026-07-29
Sebastian Raschka LLM Architecture Gallery 七月更新:6 款新开源模型架构解析 · 干货攻略
本攻略核验了 Raschka 原帖中每款模型的核心参数,所有数字均来自对应官方来源(HuggingFace 模型卡、官方博客、技术报告)。原帖描述与官方文档一致处已核对;存在差异处以官方为准并作注。 Sebastian Raschka(@rasbt)于 2026 年 7 月底更新了他维护的 LLM Architecture Gallery,一口气收录了 6 …
Jay 2026-07-29
moonshotai/Kimi-K3 · 上手攻略
Kimi K3 是 Moonshot AI(MiniMax)推出的开源权重多模态 Agent 大模型,总参数量 2.8T(激活 104B),是全球首个开放的 3T 级开源模型。K3 基于两项自研架构:Kimi Delta Attention(KDA) 和 Attention Residuals(AttnRes),采用 MoE(MixtureofExperts…
LLM 基础设施 MoonshotAI/Kimi-K3 Stars 8,340 Jay 2026-07-29
nyblnet/bento · 上手攻略
Bento 是一个单文件 HTML 办公套件——目前以幻灯片(Slides)应用为核心,规划中还包括 Docs 和 Sheets,每个都打包成独立的 .bento.html 文件。它的核心思路是:文件本身就是软件。一份 .bento.html 文件包含完整的查看器、演示模式和编辑器,不需要安装、不需要注册、不需要联网——用任何现代浏览器打开即可运行。所有内容…
工程化 nyblnet/bento Stars 3,898 Jay 2026-07-29
langwatch/better-agents · 上手攻略
Better Agents 是由 LangWatch 团队开源的 CLI 工具 + 一套工程规范,旨在让 AI 编码助手(Claude Code、Cursor、Kilocode 等)成为真正的"Agent 专家",能按照行业最佳实践构建、测试和评估 AI Agent 项目。 它不替换已有的 Agent 框架(Agno、Mastra、LangGraph 等),…
Agent 智能体 langwatch/better-agents Stars 1,553 Tom 2026-07-29
IvanMurzak/Unity-MCP · 上手攻略
UnityMCP(Unity Model Context Protocol)是一个将 Unity Editor 和 Runtime 接入 AI Agent(MCP 协议)的插件生态。装好后,AI Agent(如 Claude Code、Cursor、Copilot)能直接操作 Unity 场景、创建 GameObject、读写脚本、运行测试、截屏返回画面,实…
Agent 智能体 IvanMurzak/Unity-MCP Stars 3,859 Tom 2026-07-28
AgentEra/Agently · 上手攻略
Agently(pip install agently)是一个 Python GenAI 应用开发框架,主打"让模型输出稳定可控、让 AI 服务像后端服务一样可观测、可恢复"。它的核心抽象是 AgentExecution:把一次推理涉及的 prompt、策略、Actions、Skill 绑定、process 流、TaskContext 证据、结果视图统一收口…
Agent 智能体 AgentEra/Agently Stars 1,636 spark 2026-07-28
intentee/paddler · 上手攻略
Paddler 是一款用 Rust 写的开源 LLM/VLM 推理负载均衡与服务平台。架构非常克制:只有两个组件——balancer(对外暴露 OpenAI 兼容推理接口、管理面和 Web 控制台)和 agent(真正跑推理,注册到 balancer 上即可上线)。底层直接用 llama.cpp 推理引擎(fork 版本,Paddler 自己实现了 slot…
多模态 intentee/paddler Stars 1,651 spark 2026-07-28