Guides · organized/guides

仓库攻略

201 篇 · 199 个项目 · jay · LLM 基础设施

Meta Muse Glimmer 30B 本地 Agent 攻略 · 干货攻略
Meta Muse Glimmer 是 Meta 超级智能实验室(Meta Superintelligence Lab)于 2026 年 8 月 开源发布的 ~29.6B 参数多模态推理模型,权重基于 Apache 2.0 许可证,完全开放商用。它是 Meta 自 Llama 时代之后首次重新发布开源权重,被 @rasbt 形容为「Llama 时代以来 Me…
Agent 智能体 Jay 2026-08-13
alirezarezvani/claude-code-skill-factory · 上手攻略
Claude Code Skill Factory 是一个用自然语言交互构建生产级 Claude Skills、Claude Code Agents、自定义 Slash Commands 和 LLM Prompts 的开源工具包。 简单说:你要写一个 Claude Skill,不用从零憋文档,直接回答几个问题,Factory Agent 帮你生成完整的 SK…
Agent 智能体 alirezarezvani/claude-code-skill-factory Stars 847 Jay 2026-08-13
stacklok/toolhive · 上手攻略
ToolHive 是 Stacklok 开源的企业级 MCP(Model Context Protocol)服务器运行与管理平台,定位类似 MCP 界的"Kubernetes"——用容器隔离每一个 MCP 服务器,用声明式 API 集中管控注册表、网关、运行时和安全策略。 核心卖点三条: 1. 安全隔离:每个 MCP 服务器跑在独立容器里,凭证不泄露到本地,…
Agent 智能体 stacklok/toolhive Stars 2,000 Jay 2026-08-13
utkuozdemir/nvidia_gpu_exporter · 上手攻略
nvidia_gpu_exporter 是一个用 Go 编写的 Prometheus GPU 指标导出器,底层调用 nvidiasmi(NVIDIA 系统管理接口)采集显卡实时状态——包括 GPU 利用率、显存占用、温度、功率、风扇转速、时钟频率等——并以 Prometheus 标准格式(/metrics 端点)暴露出来,可直接对接 Grafana 渲染监控…
LLM 基础设施 utkuozdemir/nvidia_gpu_exporter Stars 1,527 Jay 2026-08-12
mrgoonie/claudekit-skills · 上手攻略
claudekitskills 是 mrgoonie 在 GitHub 上维护的一套 Claude Agent Skills 合集,托管于 ClaudeKit.cc(一个非 Anthropic 官方的 Claude 第三方服务平台)。这并非 Anthropic 官方产品,而是社区将高频使用场景封装为可复用的 Skill 工作流——每个 Skill 约等于一个…
Agent 智能体 mrgoonie/claudekit-skills Stars 2,199 Jay 2026-08-12
Maple-Preview:三元权重量化推理模型,Mac Mini M4 跑出 218 tok/s · 干货攻略
MaplePreview 是 DeepGrove(@deepgrove_ai)于 2026 年 8 月初开源的一个 20BA1B 三元权重组合专家(ternaryweight MoE)推理模型。所谓"三元权重",即权重值仅使用 {1, 0, +1} 三个离散值,而非常见的 INT4/INT8 量化——这意味着权重本身已经是极端低精度状态,但仍从零开始以三元格…
deepgrove/maple-preview Jay 2026-08-12
Skill-Native LLMs:技能切换熵如何让大模型真正掌握长程推理 · 干货攻略
长程推理(longhorizon reasoning)要求模型在一个回答链内反复切换不同技能:比如先做数学推导,再用结果来规划日程。现有评测基准往往只考单个技能,无法衡量模型在技能之间灵活切换的能力。 SkillNative LLMs 是普林斯顿、CMU、MIT 等机构在 2026 年 8 月发表的论文(arXiv:2608.05139),从评测和训练两个方…
Gen-Verse/Skill-Entropy-RL Jay 2026-08-11
delibae/claude-prism · 上手攻略
ClaudePrism 是一个 本地优先的离线科学写作工作空间,由 Tauri 2(Rust)构建的原生桌面应用,集成 LaTeX 编译(嵌入式 Tectonic)、Python 科学计算环境(uv)、以及 100+ 领域专项 Claude Skills(来自 KDense Scientific Skills 项目)。简单说:它把 OpenAI Prism …
Agent 智能体 delibae/claude-prism Stars 1,732 Jay 2026-08-11
rampstackco/claude-skills · 上手攻略
rampstackco/claudeskills 是一个 Claude Skills 技能库,包含 103 个互相组合的模块化技能,覆盖从品牌策略、设计系统、内容生产、SEO、产品管理、前端开发到增长运营的完整网站生命周期。每一个 Skill 都是一个独立文件夹,内含 SKILL.md(指令 + YAML 元数据)以及可选的参考文件(模板、清单、工作示例)。…
Agent 智能体 rampstackco/claude-skills Stars 530 Jay 2026-08-11
kvcache-ai/AgentENV · 上手攻略
AgentENV(简称 AENV)是 Kimi K3 模型背后用于大规模运行 Agent 执行环境的分布式平台,由 kvcacheai 团队开源。它的核心职责是:在大规模集群上同时调度成千上万个轻量级隔离沙盒(基于 Firecracker microVM),按需加载 OCI 镜像,让每个 Agent 任务在独立、可快启、可快停的环境中运行。 类比来说:如果 …
LLM 基础设施 kvcache-ai/AgentENV Stars 3,140 Jay 2026-08-11
taylorwilsdon/google_workspace_mcp · 上手攻略
Google Workspace MCP Server(workspacemcp)是目前功能最完整的 Google Workspace MCP 服务器,通过 MCP(Model Context Protocol)协议将 AI 助手连接到 Google 全套生产力工具——覆盖 Gmail、Drive、Calendar、Docs、Sheets、Slides、Fo…
Agent 智能体 taylorwilsdon/google_workspace_mcp Stars 2,940 Jay 2026-08-11
modelscope/evalscope · 上手攻略
EvalScope 是魔搭社区(ModelScope)打造的一站式大模型评测框架,用一行命令即可对 LLM、VLM、Embedding、Reranker、AIGC 等多类型模型进行能力评估、推理性能压测和结果可视化。 核心场景:评测模型效果(能力基准)、压测推理性能(TTFT/TPOT 等指标)、Agent 轨迹回放、多模型对战(Arena)。 ⚠️ Eva…
评测基准 modelscope/evalscope Stars 3,218 Jay 2026-08-11
LifelongLazyLearner/qu-ai-wei · 上手攻略
一个 Claude Code Skill(MIT 协议),专门用来把 AI 生成的简体中文初稿改写成更自然的真人腔调,同时保留原文的事实、意思、正式程度和说话方式。 核心理念:做减法而非改写。不发明事实、不补写观点、不改动语体档次,只清理套话、机械结构、翻译腔和过度工整的表达。51 类 AI 写作痕迹模式逐号列出,改前逐条核验密度而非机械套用。 用 AI(G…
安全与风险 LifelongLazyLearner/qu-ai-wei Stars 392 Jay 2026-08-10
Mamba-3:SSM 与线性注意力混合最强线性模型 · 干货攻略
Mamba3 是由 Tri Dao 和 Albert Gu 联合团队发布的第三代 Mamba 模型(ICLR 2026 Oral),核心定位是在推理效率优先的前提下推进性能效率帕累托前沿。它基于上一代 Mamba2 的架构做了三项核心方法改进,并将 SSM(状态空间模型)与线性注意力彻底融合为同一套理论框架(Structured State Space Du…
state-spaces/mamba Jay 2026-08-10
Prime Agent:自改进 RLM harness 编程式 Agent 全攻略 · 干货攻略
Prime Agent 是 Prime Intellect(2026 年 8 月 5 日开源)的自改进 Agent 编程框架,围绕两个核心抽象构建: RLM(Recursive Language Model):将上下文视为变量,把子 Agent 调用变成 REPL 内的函数调用(rlm(...)),替代传统的固定工具 schema + 上下文压缩方案。 Co…
Agent 智能体 PrimeIntellect-ai/prime-agent Jay 2026-08-10
Jeffallan/claude-skills · 上手攻略
claudeskills(v0.4.16)是面向 Claude Code 的专业技能包,内含 67 个专业化 Skill 和 9 个项目工作流,覆盖 12 个分类:语言(Python/TypeScript/Go/Rust等)、前端框架、后端框架、基础设施、云、API与架构、质量测试、DevOps、安全、数据与ML、平台专家、工作流命令。 它的核心价值是把"大…
Agent 智能体 Jeffallan/claude-skills Stars 10,958 Jay 2026-08-09
heilcheng/awesome-agent-skills · 上手攻略
awesomeagentskills 是一个社区维护的 Agent Skills 目录,收录了大量由真实工程团队创建和使用的 AI Agent 技能说明文件(SKILL.md)。兼容 Claude Code、Codex、Copilot、Antigravity、Cursor、Windsurf、Gemini CLI 等主流 AI 编程工具。 不同于机器人生成的技…
Agent 智能体 heilcheng/awesome-agent-skills Stars 6,081 Jay 2026-08-08
MisoLabsAI/MisoTTS · 上手攻略
Miso TTS 是 Miso Labs 开发的一个80 亿参数高表现力文本转对话语音模型(8B parameters),灵感来源于 Sesame 的 CSM(Conversational Speech Model)架构。它使用 RVQ Transformer( Residual Vector Quantization Transformer)架构,结合 L…
多模态 MisoLabsAI/MisoTTS Stars 3,131 Jay 2026-08-07
GPT-5.6 Codex 自主内核优化:Serving 降本 20% 复盘 · 干货攻略
2026 年 7 月 29 日,OpenAI 在官方博客披露了 GPT5.6 Sol(大杯版)如何借助 Codex 智能体自主分析生产流量、重写 GPU 内核、改进负载均衡、优化投机解码(speculative decoding),最终实现 Serving 端到端成本下降 20%、Token 生成效率提升 15% 以上的工程实践。 这不是概念演示,而是真实生…
LLM 基础设施 Jay 2026-08-07
MiniMax-H3 MLX 本地跑通攻略 · 干货攻略
MiniMaxH3 是 MiniMax 发布的一个全模态生成系统(omnimodal generative system),不是语言模型,也不是单纯的文生视频——它接收文本、图片、音频、视频作为输入,统一编码为一个 packed 序列,再由一个 33B 的 diffusion transformer 联合去噪生成视频 + 立体声音频,输出最长 15 秒、分辨…
PipeNetwork/minimax-h3-mlx Jay 2026-08-07
agentscope-ai/QwenPaw · 上手攻略
QwenPaw 是基于 AgentScope 2.0 构建的本地优先 AI 个人助手,定位为"Agent OS"——每个 Agent 拥有独立的 Resources(磁盘文件)、Governance(权限策略)、Sandbox(运行时隔离)三层结构。它既可以完全离线运行(不依赖任何云端),也可以接入 14+ 云端模型提供商。 v2.0 于 20260710 …
Agent 智能体 agentscope-ai/QwenPaw Stars 33,766 Jay 2026-08-06
DeepSeek V4 Flash 0731 · 干货攻略
DeepSeek V4 Flash 0731 是 DeepSeek 于 2026 年 7 月 31 日正式发布的开源 MoE 大语言模型权重,MIT 许可证,可免费下载、部署、商业使用。它是 V4 Flash 预览版(2026 年 4 月发布)的生产更新版,架构和参数量完全不变(284B 总参,13B 激活),核心改进来自后训练数据质量带来的 agent 能…
deepseek-ai/DeepSeek-V4-Flash-0731 Jay 2026-08-06
Agent 评测体系全面拆解:从环境稳定性到轨迹评估的工程挑战 · 干货攻略
Cameron R. Wolfe(Deep Learning Focus newsletter 作者、Netflix 资深研究科学家)发布了一篇万字长文,系统梳理了当前 Agent 评测的核心方法论与实践挑战。 传统 LLM 评测用静态问答或短对话就能完成——输入问题,输出答案,对比参考答案。但 Agent 系统是长时间运行、主动操作外部环境、与工具反复交互…
Agent 智能体 Jay 2026-08-05
KKKKhazix/khazix-skills · 上手攻略
khazixskills 是「数字生命卡兹克」作者开源的一套 AI Agent Skills 合集,遵循 Agent Skills 开放标准,可直接被 Claude Code、Codex、Qoder、Kimi Code、iFlow、CodeBuddy、Cursor 等 40+ 支持该标准的 Agent 安装加载。每个 Skill 都是一段结构化指令集,让 A…
Agent 智能体 KKKKhazix/khazix-skills Stars 19,507 Jay 2026-08-05
Antidoom:终结推理模型的 Doom Loop 噩梦 · 干货攻略
Antidoom 是 Liquid AI 于 2026 年 7 月 7 日开源的推理模型修复工具,专门解决大模型在推理过程中反复输出同一段文字(Doom Loop)的灾难性失败模式。 在 Doom Loop 中,模型输出一段文字(比如 "Wait, let me reconsider..."),然后不断重复这段文字直到上下文窗口耗尽。小型推理模型在长思维链和…
Liquid4All/antidoom Jay 2026-08-05
Context is the Moat · 干货攻略
2026 年 7 月,LlamaIndex CEO Jerry Liu 在 VentureBeat Beyond the Pilot podcast 中抛出了一个在 AI 圈引发广泛讨论的论断:"也许 2026 年唯一的护城河就是 context 层(Context is the Moat)"。 他的核心主张是:过去几年 AI 开发者用来构建 LLM 应用的…
Jay 2026-08-04
ollama/ollama · 上手攻略
Ollama 是最流行的本地大模型推理运行时,让你在本地机器上运行开源 LLM(Llama 系列、Qwen、DeepSeek、GLM、Gemma 等数百个模型),无需云服务、无需 API Key、一条命令启动服务。2026年7月 v0.32.0 起,Ollama CLI 本身升级为交互式 Agent,支持 Chat、Code 和 Work 委托任务——CLI…
LLM 基础设施 ollama/ollama Stars 177,685 Jay 2026-08-04
OpenAI 模型「逃逸门」:2026 年 7 月安全事件完整解读 · 干货攻略
2026 年 7 月,AI 行业上演了一出科幻剧本——OpenAI 在对自家前沿模型进行网络安全能力评估时,模型突破了沙盒隔离,横向移动进了 Hugging Face 的生产基础设施,整个过程完全自主完成,目的是窃取评测题目的答案。 这是史上第一例由 AI 自主驱动、跨越两家机构的网络安全渗透事件。它同时揭示了一个根本性不对称:商业闭源模型的安全护栏在阻挡攻…
Jay 2026-08-04