Guides · organized/guides

仓库攻略

1128 篇 · 1113 个项目

MemPalace/mempalace · 上手攻略
MemPalace 是一个本地优先的 AI 记忆系统,核心卖点是:原文逐字存储(不摘要、不压缩)、可插拔向量后端、96.6% R@5(LongMemEval 基准)以及完全零 API 调用。数据永远留存在本机,通过语义搜索而非总结来召回历史上下文。 它的组织模型借用了"记忆宫殿"的隐喻: 官方文档: | PyPI:mempalace ⚠️ 防骗警告:MemP…
评测基准 MemPalace/mempalace Stars 58,289 Jay 2026-07-10
rasbt/LLMs-from-scratch · 上手攻略
rasbt/LLMsfromscratch 是 Sebastian Raschka 的著作《Build a Large Language Model (From Scratch)》(Manning 出版,ISBN 9781633437166)的官方配套代码库。该仓库从零实现了一个类 GPT 的 LLM,涵盖数据预处理、注意力机制、模型架构、预训练、精调(SF…
工程化 rasbt/LLMs-from-scratch Stars 102,334 Jay 2026-07-10
siyuan-note/siyuan · 上手攻略
SiYuan(思源笔记)是一款隐私优先、可完全自托管的个人知识管理(PKM)软件,使用 TypeScript + Go 双语言开发,Stars 约 4.5 万,周增约 +14。它以「块(Block)」为最小数据单元,支持块级引用和双向链接(类似 Roam Research / Obsidian),采用 Markdown 所见即所得(WYSIWYG)编辑体验,…
数据与向量库 siyuan-note/siyuan Stars 45,719 Tom 2026-07-10
mudler/LocalAI · 上手攻略
LocalAI 是一个开源的本地 AI 推理引擎,2026 年 7 月 Stars 约 4.7 万,周增约 +126。核心理念是「小核心 + 按需加载后端」:每个后端(llama.cpp、vLLM、whisper.cpp、stablediffusion、MLX 等)都是独立的 OCI 镜像,只在你需要某类模型时才拉取安装。最新稳定版为 v4.3.0(2026…
多模态 mudler/LocalAI Stars 48,383 Tom 2026-07-10
Snailclimb/JavaGuide · 上手攻略
JavaGuide 是 GitHub 上规模最大的 Java 后端面试知识库,涵盖 Java 基础、并发、JVM、数据库(MySQL/Redis/MongoDB)、计算机网络、操作系统、数据结构与算法、系统设计、常用框架(Spring/SpringBoot)等核心主题。除面试内容外,还包含 AI 应用开发指南(AIGuide 子仓库),覆盖 LLM、Agen…
数据与向量库 Snailclimb/JavaGuide Stars 157,677 Tom 2026-07-10
Significant-Gravitas/AutoGPT · 上手攻略
AutoGPT 是一个创建、部署和管理持续运行 AI Agent 的平台,目标是让 AI 自动化每个人都能用、都能搭建。它包含三大核心组件: Forge(经典版):快速构建自定义 Agent 的开发工具包,配有基准测试框架 项目采用双 License:平台核心代码(autogpt_platform/ 文件夹)使用 Polyform Shield Licens…
Agent 智能体 Significant-Gravitas/AutoGPT Stars 186,506 Jay 2026-07-10
google-ai-edge/mediapipe · 上手攻略
MediaPipe 是 Google 开源的端侧机器学习框架,专注于在手机(Android/iOS)、Web、桌面、边缘设备和 IoT 上实时运行 ML 模型。它不是训练框架,而是推理框架——帮你把 Google 训练好的模型快速部署到各类设备上,以低延迟处理图像、视频、音频和文本。 Google 于 2023 年将 MediaPipe 主开发文档迁移至 d…
多模态 google-ai-edge/mediapipe Stars 36,566 Tom 2026-07-10
portkey-ai/gateway · 上手攻略
Portkey AI Gateway 是一个开源的 AI 网关(LLM Router),用单一 API 接口聚合 1600+ 语言、视觉、音频和图像模型。它既是路由层(自动重试、负载均衡、降级),也是安全层(Guardrails 内容审查),同时自带可观测性(监控、日志、成本追踪)。本质上,它是你所有 AI 应用访问大模型的统一入口。 核心定位:不再需要在代…
portkey-ai/gateway Tom 2026-07-10
fareedkhan-dev/train-llm-from-scratch · 上手攻略
一个从零开始训练完整大语言模型(LLM)的全链路教程仓库。手写 PyTorch 实现,不依赖 transformers、trl、peft 等高层库,从文本语料处理讲起,一路走到 SFT(监督微调)→ 奖励模型 → RLHF(PPO、DPO、GRPO),覆盖一个小型 LLM 从诞生到"会聊天"的全过程。 项目作者 FareedKhandev 目前在寻找 AI …
fareedkhan-dev/train-llm-from-scratch Tom 2026-07-10
miurla/morphic · 上手攻略
Morphic 是一个带有生成式 UI 的 AI 驱动搜索引擎。用户输入查询,它调用 AI 搜索多源内容,实时流式返回带引用来源的答案,答案中的内容块(图片、网格、标题)以结构化组件实时渲染,而非普通 Markdown 文本。 核心特点:Grounded answers with cited sources + Generative UI(生成式界面)。 1…
RAG 检索增强 miurla/morphic Stars 9,035 Jay 2026-07-10
BentoML/BentoML · 上手攻略
BentoML 是一个 Python 库,用于构建和部署 AI 模型推理服务。它将任意 AI/ML 模型的推理代码,通过几行装饰器注解,自动变成可扩展的 HTTP API,并支持 Docker 镜像打包、模型版本管理、动态批处理、多模型编排等生产级特性。 核心理念:"Build Model Inference APIs, Job queues, LLM ap…
LLM 基础设施 bentoml/BentoML Stars 8,776 Jay 2026-07-10
OpenRLHF/OpenRLHF · 上手攻略
OpenRLHF 是一个基于 Ray + vLLM 分布式架构的高性能 RLHF(从人类反馈中强化学习)训练框架,同时首创了统一的 Agent 执行范式。它能将 PPO、REINFORCE++、GRPO、RLOO 等 RL 算法,与单轮/多轮 Agent 执行模式自由组合,支持 70B+ 参数模型的分布式训练,并可通过 vLLM 加速生成阶段(RLHF 中耗…
Agent 智能体 OpenRLHF/OpenRLHF Stars 9,902 Jay 2026-07-10
xLLM-AI/xllm · 上手攻略
xLLM 是由京东零售团队开发、现托管于 OpenAtom 基金会的高性能 LLM 推理引擎。它不是面向普通用户的 AI 产品,而是给企业级部署场景用的底层 Infra 工具——目标是让大模型的推理在特定 AI 加速器上跑得更快、更划算。 支持的模型类型不只有 LLM,还包括: LLM(大语言模型) VLM(视觉语言模型) DiT(扩散Transformer…
多模态 xLLM-AI/xllm Stars 1,516 Jay 2026-07-10
stas00/ml-engineering · 上手攻略
stas00/mlengineering 是一本机器学习工程开放手册,由 Meta(参与 BLOOM176B 训练)、HuggingFace(参与 BLOOM176B、IDEFICS80B 训练)、Contextual.AI 等一线团队的 ML 工程师 Stas Bekman 多年实战经验沉淀而成。 与一般教程不同,它不是教你怎么用 transformers…
工程化 stas00/ml-engineering Stars 18,696 Tom 2026-07-10
assafelovic/gpt-researcher · 上手攻略
GPT Researcher 是一个开源的自主深度研究 Agent,设计用于对任意主题进行系统性网络调研或本地文档分析。它受 PlanandSolve 和 RAG 论文启发,通过「规划 Agent + 执行 Agent」的并行架构解决传统 LLM 调研的几大痛点:信息陈旧、幻觉、Token 限制、来源单一、结论偏颇。 核心思路是:Planner 生成一组研究…
Agent 智能体 assafelovic/gpt-researcher Stars 28,921 Tom 2026-07-10
jeecgboot/JeecgBoot · 上手攻略
JeecgBoot 是一款企业级 AI 低代码平台,基于 Java(Spring Boot 2/3)和 Vue3,核心理念是"低代码 + AI"双轮驱动——用低代码提升 CRUD 开发效率,用 AI 降低使用门槛。 核心定位: 面向企业内部的 MIS/OA/ERP 系统快速构建; 最新稳定版:3.8.3(20251009),基于 SpringBoot 2;S…
工程化 jeecgboot/JeecgBoot Stars 47,359 Jay 2026-07-10
milvus-io/milvus · 上手攻略
Milvus 是一款高性能、云原生的向量数据库,专为大规模向量 ANN(近似最近邻)搜索场景设计。它能够存储十亿级向量,支持实时插入与查询,广泛用于 AI 应用中的语义搜索、图像检索、RAG(检索增强生成)等场景。 核心特点: 官方提供完全托管云服务 Zilliz Cloud。 1. 向量数据量大时搜索慢 — 传统数据库无法高效做向量相似度搜索,Milvus…
数据与向量库 milvus-io/milvus Stars 45,770 Jay 2026-07-10
cobusgreyling/loop-engineering · 上手攻略
Loop Engineering 是一个面向 AI 编码 Agent 的循环设计系统与工具集。核心理念来自 Addy Osmani 和 Boris Cherny(Anthropic Claude Code 负责人)的一个观察: "你不应该再自己去 Prompt 编码 Agent 了。你应该设计循环系统,让系统来 Prompt 你的 Agent。" 换句话说:…
Agent 智能体 cobusgreyling/loop-engineering Stars 9,938 Tom 2026-07-10
lobehub/lobehub · 上手攻略
LobeHub 是一个首席 Agent 运营平台(Chief Agent Operator),核心理念是把 AI Agent 视为团队成员来管理——招聘(创建)、排班(调度)、汇报(生成报告),让你的 Agent 团队实现 7×24 不间断运转。 当前主流 Agent 的问题是:每次任务单独触发、无上下文、无协作、无法持续运行。LobeHub 改变了这一点,…
Agent 智能体 lobehub/lobehub Stars 81,480 Tom 2026-07-10
stefan-jansen/machine-learning-for-trading · 上手攻略
这是《Machine Learning for Trading, 3rd Edition》(机器学习与量化交易·第三版)的配套代码库,由量化投资顾问 Stefan Jansen 编写。与前两版不同,第三版从一本技术书彻底重构成了端到端研究生产工作流:从数据获取、因子研究、模型训练、回测评估,到实盘接入经纪商,全流程跑通。 全书配套 6 个生产级 Python…
工程化 stefan-jansen/machine-learning-for-trading Stars 20,628 Tom 2026-07-10
tensorzero/tensorzero · 上手攻略
⚠️ 重要注意:该仓库已于 2026 年 6 月 12 日被官方归档(readonly)。本文档如实记录其功能与用法;后续是否由社区 fork 延续请关注 GitHub。已生产使用的项目请评估替代方案(如 Langfuse、vLLM Gateway 等)。 TensorZero 是一个开源 LLMOps 平台,用 Rust 编写,以单一 Docker 容器交…
评测基准 tensorzero/tensorzero Stars 11,724 Jay 2026-07-09
ray-project/ray · 上手攻略
Ray 是一个统一分布式 AI 计算框架,用于将 Python 和 AI 应用从单机扩展到集群。核心由两部分组成: 一句话定位:让你用同一套 Python 代码,从笔记本无缝扩展到数千节点集群,不需要懂分布式系统。 ML 和 LLM 工作流的三大挑战: 1. 单机算力不够:大模型训练/推理、微调、SFT 需要多机多卡,单机环境无法承载 2. 分布式门槛高:手…
LLM 基础设施 ray-project/ray Stars 43,599 Jay 2026-07-09
langfuse/langfuse · 上手攻略
Langfuse 是一个开源 LLM 工程平台,帮助团队协作地开发、监控、评测和调试 AI 应用。2026 年 1 月,Langfuse 团队加入 ClickHouse,继续深耕开源可观测性领域。它同时提供 Langfuse Cloud(托管版,有慷慨的免费额度)和私有化部署(Docker Compose,一键起立)。 核心功能覆盖 LLM 应用全生命周期:…
评测基准 langfuse/langfuse Stars 33,761 Jay 2026-07-09
kestra-io/kestra · 上手攻略
Kestra 是一个开源的事件驱动编排与调度平台,用于构建数据管道、AI 工作流和基础设施自动化。它的核心设计理念是:Everything as Code + Everything from UI——你既可以在可视化界面里拖拽构建工作流,也可以把 YAML 定义提交到 Git,用 CI/CD 管理版本。 定位上,它接近 Apache Airflow 的功能复…
工程化 kestra-io/kestra Stars 27,748 Tom 2026-07-09
topoteretes/cognee · 上手攻略
Cognee(发音接近"cogknee")是一个开源的 AI 记忆平台,专门为 AI Agent 设计持久化长期记忆能力。它的核心理念是:让 AI 不再是"每次对话都是一张白纸",而是可以跨会话记住关键信息、实体关系和上下文。 Cognee 的记忆架构结合了向量检索(语义搜索)+ 知识图谱(关系推理)+ 认知科学启发的本体生成,文档不仅能被"按意思找到",还…
Agent 智能体 topoteretes/cognee Stars 29,948 Tom 2026-07-09
langgenius/dify · 上手攻略
Dify 是一个开源的 LLM 应用开发平台,将 AI 应用的全生命周期管理浓缩到一个直观的界面中。它同时支持"零代码"可视化编排和后端 API 调用,定位介于 LangChain 的灵活度和 Dify 的开箱即用之间——你不需要写 Python 就能跑起一个完整的 AI 应用,但一旦需要深度定制,Dify 也提供了足够的扩展性。 官方给它的定义是:Prod…
Agent 智能体 langgenius/dify Stars 152,959 Tom 2026-07-09
songquanpeng/one-api · 上手攻略
One API 是一个开源的 LLM API 管理与分发系统,用统一的 OpenAI API 格式暴露所有主流大模型接口,支持 API Key 管理、负载均衡、令牌配额控制、用户权限管理和二次分发。 通俗来说:你在 One API 后台配置好各渠道(OpenAI、Claude、Gemini、DeepSeek 等)的 API Key,对外只暴露一个 API 地…
LLM 基础设施 songquanpeng/one-api Stars 36,309 Jay 2026-07-09
microsoft/playwright-mcp · 上手攻略
Playwright MCP Server 是微软 Playwright 团队开源的 Model Context Protocol(MCP)服务器,让大语言模型(LLM)可以通过标准化的 MCP 协议驱动真实浏览器,完成网页交互、自动化测试、表单填写等任务。 它的核心特点:不需要视觉模型,基于 Playwright 的无障碍树(Accessibility T…
Agent 智能体 microsoft/playwright-mcp Stars 35,979 Jay 2026-07-09
jaywcjlove/awesome-mac · 上手攻略
awesomemac 是一个持续维护的精选 macOS 软件榜单,按类别系统整理,现已收录超 10.7 万 Stars(截至 20260709)。项目最初只是个人整理的黑苹果软件列表,后来逐步演变为 macOS 平台最全面的开源/免费软件导航站之一,涵盖从文本编辑器到 AI 工具的完整生态。 它解决的问题很直接:macOS 用户不知道什么软件值得装。网上搜索…
工程化 jaywcjlove/awesome-mac Stars 110,068 Jay 2026-07-09
Andyyyy64/whichllm · 上手攻略
whichllm 是一个本地大模型硬件适配工具,一条命令帮你找出"在你的电脑上真正能跑且表现最好"的本地 LLM。它不是模型本身,而是一个智能选型引擎:读取你机器的 GPU/CPU/RAM 配置,去 HuggingFace 实时拉模型列表和基准测试数据,然后给你一份排名。 核心哲学:参数量不等于性能。一个 27B Q5 量化模型可能比 32B Q2 更快更准…
评测基准 Andyyyy64/whichllm Stars 6,205 Tom 2026-07-09