研究库 实战攻略
Guides · organized/guides

仓库攻略

31 篇 · 31 个项目 · LLM 基础设施 · tom · Agent 智能体

NVIDIA/kvpress · 上手攻略
KVPress 是 NVIDIA 出品的 KV Cache 压缩工具包,通过在 prefilling 阶段对注意力层的 KeyValue 缓存做选择性剪枝,把大上下文模型的显存占用压到原来的几分之一。全程无需训练、即装即用,支持 14+ 种压缩算法统一评测 pipeline。核心价值:让 128K~1M token 的长上下文推理在消费级 / 单卡服务器上变…
LLM 基础设施 `NVIDIA/kvpress` Tom 2026-10-02
Osmantic/ODS · 上手攻略
ODS(Osmantic Deployment System)将 Ollama、Open WebUI、n8n、ComfyUI 等多个开源 AI 组件一键打包成本地 AI 服务器。一条命令把 PC / Mac / Linux 变成私有 AI 工作站:本地推理、聊天界面、控制面板、语音 / Agent / 工作流、RAG 本地搜索、图片生成,全部无需云端、不用订…
LLM 基础设施 Osmantic/ODS Stars 7,167 Tom 2026-09-28
yibie/awesome-jev · 上手攻略
yibie/awesomejev 是 Jev 生态的社区精选实战案例合集,由个人维护(owner 为 yibie),聚焦「谁在生产里真的用 Jev 做了决策」这个问题。它不是 SDK,也不是工具库,而是一份按应用域分类的场景索引——把散落在 GitHub Issues、Twitter/X 讨论、博客、工程帖里的 Jev 实战案例收拢成册,供开发者快速扫描「别…
LLM 基础设施 yibie/awesome-jev Stars 1,257 Tom 2026-09-23
AbdelStark/awesome-typesafe · 上手攻略
awesometypesafe 是一个关于 TypeSafe AI(System One / Jev 模型)生态的精选资源列表,由社区维护(与 TypeSafe 公司无附属关系)。 TypeSafe 的核心产品是 Jev——一个专门做「结构化决策」的模型:不给自由文本,而是返回类型化的概率决策(Choice 多选一、Score 打分、Noul 二选一)。这个…
LLM 基础设施 AbdelStark/awesome-typesafe Stars 384 Tom 2026-09-21
TheoLeeCJ/SemIf · 上手攻略
SemIf(Semantic Ifs)是一个用开源 LLM 直接读取 typed option logits做运行时决策的开源工具。它让模型在单次前向传播内直接输出选项概率,而无需生成文本再解析——"不要 token,只要 logits"。 原名 OpenJev,后改名 SemIf,是独立研究项目,非 Jev / TypeSafe 官方。Jev 是 Type…
LLM 基础设施 TheoLeeCJ/SemIf Stars 1,648 Tom 2026-09-19
TheoLeeCJ/openjev · 上手攻略
OpenJev 是一个开源项目,试图在消费级 GPU(RTX 3090)上复现 TypeSafe 的 Jev 服务——一种语义决策操作符(semantic decision operator)。它的核心思路是:不让模型生成文本,而是直接读取模型在固定 answer token 上的 logits,经过一次 softmax 得到每个选项的概率。 ⚠️ 本仓库复…
LLM 基础设施 TheoLeeCJ/openjev Stars 964 Tom 2026-09-18
MiaAI-Lab/DeepSeek-v4.1-Flash-DGX-Sparks · 上手攻略
这是一个在 34 台 NVIDIA DGX Spark 节点上通过 SGLang 部署 DeepSeekV4.1Flash 模型的生产级推理方案。模型以 MXFP4 稀疏专家 + FP8 密集权重运行,KV Cache 由 NVMe + 统一内存共同支撑,提供 OpenAI 兼容的 /v1/chat/completions 接口,支持 Tool Callin…
LLM 基础设施 MiaAI-Lab/DeepSeek-v4.1-Flash-DGX-Sparks Stars 118 Tom 2026-09-16
MiaAI-Lab/Qwen3.8-Flash-Next-Single-DGX-Spark · 上手攻略
一个开箱即用的部署配方(recipe),用于在单台 NVIDIA DGX Spark(GB10,121 GiB 统一内存)上通过 vLLM 服务 Qwen3.8FlashNextNVFP4 大模型。 核心工程挑战:Qwen3.8FlashNext 原版 FP8 权重约 135 GB,单台 Spark 只有 128 GB 统一内存,直接跑会 OOM。这个配方通…
LLM 基础设施 MiaAI-Lab/Qwen3.8-Flash-Next-Single-DGX-Spark Stars 291 Tom 2026-09-09
luban-agi/Awesome-AIGC-Tutorials · 上手攻略
AwesomeAIGCTutorials 是一个人工策划的 AIGC 学习资源合集,按主题分为 Large Language Models(LLM)、AI Painting、AI Audio、Multimodal、Deep Learning、AI System 等大类,收录大学课程(Stanford CS324、CMU 11667 等)、行业培训(DeepL…
LLM 基础设施 luban-agi/Awesome-AIGC-Tutorials Stars 4,531 Tom 2026-08-27
ArronAI007/Awesome-AGI · 上手攻略
AwesomeAGI 是一个中文 AGI(通用人工智能)学习资源汇总仓库,持续更新,收录大语言模型(LLM)、AIGC(AI 生成内容)相关的论文、教程、工具、项目和数据集。按内容形态分为五大模块: 本质上这是一个用 README.md 维护的中文 AI 学习地图,按主题分类整理了社区主流资源,适合作为"遇到某个方向不知道看什么"时的第一站。 AGI / L…
LLM 基础设施 ArronAI007/Awesome-AGI Stars 513 Tom 2026-08-27
codexu/note-gen · 上手攻略
NoteGen 是一款本地优先的 Markdown AI 笔记应用,核心理念是"先捕获,后整理"——把灵感、语音、图片、链接等各种碎片先一股脑存下来,回头再挑选素材组织成结构化笔记。它不是要替代你的 Markdown 编辑器,而是给普通 Markdown 文件加上 AI 聚合、智能搜索和知识库的能力。 GitHub Stars:12685(数据截至 2026…
LLM 基础设施 codexu/note-gen Stars 12,685 Tom 2026-08-27
yjh051108/dsh-routing-suite · 上手攻略
dshroutingsuite 是一个聚合套装,由两个独立维护的组件构成,专门解决「DSH 运行时缺乏任务感知思维模式路由」的问题。它不是一个独立的 AI Agent,而是 DSH(DeepSeek Host)生态的运行时增强层。 核心组成: | 组件 | 仓库 | 版本 | 职能 | ||||| | injector/ | dshsuperinjector…
LLM 基础设施 yjh051108/dsh-routing-suite Stars 7,031 Tom 2026-08-22
trefeon/freebuff-proxy · 上手攻略
freebuffproxy 是一个本地网关,把 FreeBuff/Codebuff 的免费 AI 编程模型(deepseekv4flash 等)以 OpenAI 兼容接口(/v1/chat/completions)暴露给任意工具——OpenCode、pi、9router、LiteLLM 或自己的脚本。 它的核心价值是"翻译 + 池化 + 隐匿": FreeB…
LLM 基础设施 trefeon/freebuff-proxy Stars 85 Tom 2026-08-16
wangxuqi/Prompt-Engineering-Guide-Chinese · 上手攻略
PromptEngineeringGuideChinese(Prompt 工程师指南中文版)是由 wangxuqi 维护的中文翻译项目,翻译自 DAIR.AI 的英文原版 dairai/PromptEngineeringGuide(Stars 77.3k+)。原版是目前最全面、最活跃的 Prompt 工程开源教程,涵盖从基础概念到高级技巧的完整知识体系。 本…
LLM 基础设施 wangxuqi/Prompt-Engineering-Guide-Chinese Stars 1,393 Tom 2026-08-14
MetaTool-AI/MetaMCP · 上手攻略
MetaMCP 是一个 MCP(Model Context Protocol)代理基础设施,集 MCP 服务器聚合(Aggregator)、编排(Orchestrator)、中间件(Middleware)、网关(Gateway)于一个 Docker 容器。它的核心定位是:让你不必逐个管理多个 MCP 服务器,而是把它们聚合成一个统一端点,再对外暴露。 技术本…
LLM 基础设施 MetaTool-AI/MetaMCP Tom 2026-08-14
DSXiangLi/DecryptPrompt · 上手攻略
DecryptPrompt 是一个大模型提示词/Agent/RAG/LLM 全栈知识图谱,收录 Prompt 论文、开源模型、推理框架、SFT/RLHF 数据集、AIGC 应用案例等多个维度的资源。更重要的是,作者维护了一个持续更新的"解密Prompt"系列博客(65+ 篇),每篇包含论文串讲+代码实现,覆盖从 Prompt Tuning 到 RLHF、Ag…
LLM 基础设施 DSXiangLi/DecryptPrompt Stars 3,432 Tom 2026-08-13
NVIDIA/GenerativeAIExamples · 上手攻略
NVIDIA/GenerativeAIExamples 是 NVIDIA 官方的生成式 AI 参考工作流仓库,针对加速基础设施(GPU/NIM 微服务)做了深度优化,涵盖 RAG 管道、Agentic 工作流、知识图谱、视觉 NIM 工作流、Data Flywheel 完整闭环等场景。当前最新 release 为 v0.8.x(2025 年),目录结构已完成…
LLM 基础设施 NVIDIA/GenerativeAIExamples Stars 4,144 Tom 2026-08-11
algorithmicsuperintelligence/optillm · 上手攻略
OptiLLM 是一个OpenAI API 兼容的推理优化代理(inference proxy),通过在推理时(inferencetime)应用 20+ 种推理优化技术,在不需要任何训练或微调的情况下,将 LLM 在数学、代码、逻辑推理任务上的准确率提升 210 倍。 它的核心思路是:在现有 API 调用层加一层代理,对请求进行后处理(优化推理路径),再转发…
LLM 基础设施 algorithmicsuperintelligence/optillm Stars 4,236 Tom 2026-08-10
decolua/9router · 上手攻略
9Router 是一个本地智能路由器,串联在你常用的 AI 编码 CLI 工具(如 Claude Code、Codex、Cursor、Cline、Copilot、OpenClaw 等)与各路 LLM API 提供商之间。它解决的核心问题是:订阅浪费、速率限制、格式不兼容、手动切换。 架构上,它是一个跑在本地的 HTTP 代理服务(默认 localhost:2…
LLM 基础设施 decolua/9router Stars 25,148 Tom 2026-08-07
envoyproxy/ai-gateway · 上手攻略
envoyproxy/aigateway 是 Envoy 生态下的 AI 网关项目,基于 Envoy Gateway 扩展,专门处理应用客户端到生成式 AI(GenAI)服务的流量。它的本质是一个 Kubernetes 原生的 LLM 流量管理平面,提供路由、认证、限流、弹性Failover等企业级能力。 Envoy 是 CNCF 旗下久经生产验证的代理,M…
LLM 基础设施 envoyproxy/ai-gateway Stars 1,919 Tom 2026-07-30
mozilla-ai/any-llm · 上手攻略
anyllm 是 Mozilla AI 团队推出的 Python 库,目标是让你用同一套代码调用任何 LLM 提供商,无需改业务逻辑。 它的核心理念很清晰:LLM 提供商的 API 接口碎片化严重——OpenAI、Anthropic、Azure、Mistral、Ollama……各家参数名、响应格式、错误处理各有差异。anyllm 不重新造轮子,而是封装官方 …
LLM 基础设施 mozilla-ai/any-llm Stars 2,150 Tom 2026-07-30
raullenchai/Rapid-MLX · 上手攻略
RapidMLX 是目前 Apple Silicon 上速度最快的本地 AI 推理引擎,专为 M 系列芯片优化,基于 Apple MLX 框架重写所有核心 kernel,纯 Metal GPU 加速,无任何 llama.cpp 回退或 Python 桥接层。相比同场景的 Ollama,吞吐量提升约 4.2 倍,首 token 时间(TTFT)可低至 0.08…
LLM 基础设施 raullenchai/Rapid-MLX Stars 3,433 Tom 2026-07-22
OpenMOSS/MOSS · 上手攻略
MOSS(MultiOmni Scale System)是复旦大学开源的工具增强型对话语言模型,具有 160 亿参数(16B),支持中英双语、多轮对话,以及插件调用能力(搜索、文生图、计算器、解方程)。 该项目开源内容包括: 本质上,这是一个可以调用工具的中文 ChatGPT 风格模型,可以在本地私有部署,参数规模比 GPT4 小但远大于早期开源 7B 模型…
LLM 基础设施 OpenMOSS/MOSS Stars 12,211 Tom 2026-07-15
traceloop/openllmetry · 上手攻略
OpenLLMetry(发音「openLLmetry」)是基于 OpenTelemetry 的开源 LLM 应用可观测性工具,由 Y Combinator 支持的 Traceloop 公司开发和维护(Apache 2.0 许可)。 它的核心思路:用 OpenTelemetry 标准采集 LLM 应用的全链路追踪数据,无需更换你现有的可观测性基础设施(Data…
LLM 基础设施 traceloop/openllmetry Stars 7,367 Tom 2026-07-14
dyad-sh/dyad · 上手攻略
Dyad 是一个本地运行、开源免费的 AI 应用构建工具(v0 / Lovable / Replit / Bolt 的开源替代)。用户通过自然语言描述需求,Dyad 自动生成完整的全栈应用代码,全程在本地机器运行,不依赖云端平台,不锁死生态,代码完全属于你自己。 支持 macOS 和 Windows,下载即可使用,无需注册。 1. 前往官网下载页面: 2. …
LLM 基础设施 dyad-sh/dyad Stars 21,197 Tom 2026-07-13
chatanywhere/GPT_API_free · 上手攻略
chatanywhere/GPT_API_free 是一个免费中转 API 服务,让国内用户无需科学上网即可调用 OpenAI GPT 系列、DeepSeek、Claude(Anthropic 官方协议)、Gemini、Qwen、Kimi、GLM、Minimax 等主流大模型的 API 接口。项目提供免费 API Key(每日限额),也支持付费 Key 获取…
LLM 基础设施 chatanywhere/GPT_API_free Stars 40,079 Tom 2026-07-13
vllm-project/vllm-omni · 上手攻略
vLLMOmni 是 vLLM 社区推出的全模式(omnimodality)推理框架,将 vLLM 的高性能 LLM 推理能力扩展到任意到任意的多模态模型——不只是理解图像/视频/音频,而是能同时生成多种模态的输出(文本+图像+视频+音频)。 支持的输出类型: 一句话概括:vLLM 在多模态生成领域的扩展,让研究者和企业能用生产级性能跑 OmniModali…
LLM 基础设施 vllm-project/vllm-omni Stars 6,027 Tom 2026-07-13
microsoft/generative-ai-for-beginners · 上手攻略
微软官方出品的 21 节生成式 AI 入门课程,覆盖从 LLM 基础理论到 AI Agent 开发完整路径。每节包含讲解视频(YouTube)+ 文字课程 + Python/TypeScript 双语言代码示例,并配套 50+ 语言的社区翻译。Stars 约 112k,是微软 GitHub 最受欢迎的教育类仓库之一。 课程默认使用 Azure OpenAI …
LLM 基础设施 microsoft/generative-ai-for-beginners Stars 117,401 Tom 2026-07-10
0xPlaygrounds/rig · 上手攻略
Rig 是用 Rust 构建模块化、可扩展 LLM 应用的库。它提供了一套统一抽象,覆盖 20+ 大模型提供商、10+ 向量数据库,并内置 Agent 编排、RAG、工具调用、多轮对话等能力,全部用 Rust 的类型安全和并发性能加持。 解决什么问题: 在 Rust 生态里,之前缺乏一个统一、好用的 LLM 应用抽象层。开发者要么自己封装各个 Provide…
LLM 基础设施 0xPlaygrounds/rig Stars 8,237 Tom 2026-07-10
sgl-project/sglang · 上手攻略
SGLang 是一个高性能大语言模型(及多模态模型)推理 serving 框架,由 LMSYS 组织开发维护(Apache2.0 许可证)。它的核心定位是 vLLM 的直接竞争对手,在多项 benchmark 上展示出更高的吞吐量和更低的延迟。SGLang 底层基于 PyTorch,支持 RadixAttention(前缀缓存)、连续批处理(continuo…
LLM 基础设施 sgl-project/sglang Stars 31,657 Tom 2026-07-07