Guides · organized/guides

仓库攻略

308 篇 · 307 个项目 · 评测基准

linshenkx/prompt-optimizer · 上手攻略
Prompt Optimizer 是一款开源 AI 提示词优化工具,通过多轮迭代改进帮助用户写出更高质量的提示词,从而获得更好的 AI 输出。支持 Web 应用、桌面客户端、Chrome 扩展和 Docker 部署四种形态,可对接 OpenAI、DeepSeek、Gemini、Grok、Zhipu AI、SiliconFlow、MiniMax 等主流模型,并…
工程化 [linshenkx/prompt-optimizer](https://github.com/linshenkx/prompt-optimizer) Tom 2026-08-17
nomic-ai/gpt4all · 上手攻略
GPT4All 是由 Nomic AI 开发的开源本地大模型运行工具,核心目标是让任何人在不需要 GPU、不需要 API key、不需要云服务的情况下,在自己的电脑(笔记本、台式机)上跑大语言模型(LLM)。 本质上是基于 llama.cpp 的工程封装,提供三件套: 桌面应用(GPT4All Desktop):图形界面聊天,支持 LocalDocs(本地文…
LLM 基础设施 nomic-ai/gpt4all Stars 77,407 Tom 2026-08-17
StarlightSearch/EmbedAnything · 上手攻略
StarlightSearch/EmbedAnything 是一个用 Rust 构建的高性能、多模态 embedding 管道。它支持从文本、图片、音频、PDF、网站等多种来源生成向量嵌入,并与 Milvus、Weaviate、Elastic、SingleStore 等主流向量数据库无缝对接,核心卖点是零 PyTorch 依赖、低内存占用、流式索引,已在 E…
LLM 基础设施 StarlightSearch/EmbedAnything Stars 1,294 Jay 2026-08-17
LFM2.5-2.6B vs DeepSeek-V4-Flash 工具调用平手,吞吐量 3.7 倍 · 干货攻略
LFM2.52.6B 是 Liquid AI 在 2026 年 8 月初开源的一个 2.6B 参数端侧 Agent 模型,DeepSeekV4Flash0731 是 DeepSeek 同月发布的一个 284B 总参数 / 13B 激活参数 MoE 推理优化模型(20260731 发布)。2026 年 8 月 6 日,atomic.chat 在 4× RTX …
LiquidAI/LFM2.5-2.6B(Hugging Face,无 GitHub 仓库) Jay 2026-08-17
opendatalab/MinerU · 上手攻略
MinerU 是由 OpenDataLab(上海人工智能实验室关联开源组织)开发的高精度文档解析引擎,于 2024 年开源。其核心能力是:将 PDF、DOCX、PPTX、XLSX、图片、网页等复杂文档,转换为 LLM 可直接消费的 Markdown 或 JSON 格式,同时保留阅读顺序、标题层级、表格结构、公式 LaTeX 等语义信息。 MinerU 最早服…
Agent 智能体 opendatalab/MinerU Stars 76,653 Jay 2026-08-17
mlabonne/llm-course · 上手攻略
mlabonne/llmcourse 是由法国机器学习工程师 Maxime Labonne 维护的一套免费、开源的大语言模型(LLM)学习路径仓库,GitHub Stars 超过 81,000(2026年8月)。它不是传统意义上的"课程",而是一份精心编排的知识图谱——包含路线图(roadmap)、Colab Notebook 实践代码、配套博客文章,覆盖从…
LLM 基础设施 mlabonne/llm-course Stars 81,404 Jay 2026-08-17
openai/codex · 上手攻略
Codex CLI 是 OpenAI 官方推出的轻量级终端编程智能体(coding agent),于 2025 年 4 月开源发布。与面向 IDE 插件的 Codex(Codex for IDE)不同,Codex CLI 是完全运行在终端的独立工具,支持 macOS、Linux、Windows 全平台。它由 OpenAI 的编码专用模型驱动,能理解代码库、读…
Agent 智能体 openai/codex Stars 103,608 Jay 2026-08-17
EvoRubric:让评分标准自我演化的 RL 框架 · 干货攻略
EvoRubric 是一个单策略(singlepolicy)协同演化 RL 框架,由阿里巴巴通义实验室( Tongyi Lab)提出,发表在 arXiv(arXiv:2605.29847,2026年5月28日投稿)。 它的核心思路是:把「生成回复」(Reasoner)和「生成评分标准」(Rubric Generator)统一到一个参数化策略里,让两者在 RL…
Jay 2026-08-16
Ar9av/PaperOrchestra · 上手攻略
PaperOrchestra 是 Google 研究团队(Song et al., 2026)提出的一种多智能体学术论文写作框架(arXiv:2604.05018),其核心思路是用 5 个专责 Agent 流水线协作,把零散的研究材料(想法、实验记录、图表)转化为可直接投稿的 LaTeX 论文。 Ar9av/PaperOrchestra 则是将这篇论文的实现…
Agent 智能体 Ar9av/PaperOrchestra Stars 636 Tom 2026-08-16
Sushegaad/Claude-Skills-Governance-Risk-and-Compliance · 上手攻略
这是面向 Claude Code CLI 的一套 GRC(Governance, Risk, and Compliance)领域 Skill 合集,共覆盖 30+ 部法规框架,包括 ISO 27001、SOC 2、FedRAMP、GDPR、HIPAA、NIST CSF、PCI DSS、EU AI Act、ISO 42001、ISO 27701、DORA、CS…
评测基准 Sushegaad/Claude-Skills-Governance-Risk-and-Compliance Stars 814 Tom 2026-08-16
evilsocket/nerve · 上手攻略
Nerve(The Simple Agent Development Kit)是一个用 YAML + CLI 构建、运行、评测和编排 LLM Agent 的轻量框架。它的核心理念是声明式 Agent:用 YAML 定义 system prompt、task、tools 和 variables,一个文件搞定一个 Agent,再通过 nerve CLI 驱动执行…
Agent 智能体 evilsocket/nerve Stars 1,318 Jay 2026-08-16
plurai-ai/intellagent · 上手攻略
IntellAgent 是一个多智能体(multiagent)框架,专注于对话式 AI Agent 的系统性评测与诊断。 传统 agent 评测依赖人工构造测试用例,数量有限且难以覆盖真实世界的长尾边界情况。IntellAgent 的思路是:给定你的 agent 描述(prompt、工具定义、数据库 schema),自动生成数千种真实感强的边缘场景(edge…
Agent 智能体 plurai-ai/intellagent Stars 1,254 Tom 2026-08-15
Inherent Faraday:让27B模型学会做科研复现 · 干货攻略
Faraday 是伦敦 AI 创业公司 Inherent(2026年8月14日刚从 stealth 模式浮出水面,Index Ventures 与 Radical Ventures 联合注资 $50M seed round)发布的 27B 参数"AI Scientist"智能体。其核心能力是复现学术论文中的图表——给定一篇论文(不带原图),Faraday 需…
Jay 2026-08-15
NVIDIA-AI-Blueprints/video-search-and-summarization · 上手攻略
NVIDIA Video Search and Summarization(VSS)Blueprint 是一套GPU 加速的视频语义理解和分析参考架构。它将视觉语言模型(VLM,如 NVIDIA Cosmos)、大语言模型(LLM,如 Nemotron)、RAG 和 NVIDIA NIM 微服务整合在一起,实现用自然语言搜索视频内容、实时异常检测、视频问答和…
多模态 NVIDIA-AI-Blueprints/video-search-and-summarization Stars 1,790 Tom 2026-08-15
AI-Hypercomputer/maxtext · 上手攻略
MaxText 是 Google AIHypercomputer 团队开源的高性能、高可扩展 LLM 训练与后训练库,全部用纯 Python/JAX 编写,目标是 TPU 和 NVIDIA GPU 上的高效分布式训练与微调。官方于 20250915 发布 PyPI 包,当前稳定版本 0.2.3(2026 年初)。 MaxText 的定位是"LLM 项目发射台…
LLM 基础设施 AI-Hypercomputer/maxtext Stars 2,401 Tom 2026-08-15
Electricitysheep/dsh-handbook · 上手攻略
DeepSeek Harness(dsh) 是 DeepSeek 官方于 20260813 开源的 Agent 运行时框架,MIT 许可证,用 TypeScript 开发。其核心理念是"一切皆插件"(everything is a plugin)——整个系统由一个可插拔的 profile 骨架和 60+ 官方能力包组成,模型无关,支持 Claude、GPT、…
Agent 智能体 Electricitysheep/dsh-handbook Stars 197 Tom 2026-08-15
用 Codex Desktop + GPT-5.6 Sol Ultra 单次生成完整 3D 游戏的完整复盘 · 干货攻略
2026 年 8 月 7 日,知名 AI 工程博主 Simon Willison(@simonw)用 Codex Desktop 跑了 GPT5.6 Sol Ultra,一次提示词,52 分钟,零人工干预,直接生成一个完整可玩的 3D 浣熊偷盗游戏「Moonlight & Mayhem」。 游戏特点: 博物馆场景,三只浣熊组队潜入 需要解救同伴、叠罗汉偷取「…
simonw/raccoon-heist-codex Jay 2026-08-14
papis/papis · 上手攻略
papis 是一个"高度可扩展的命令行文献与书目管理器",用 Python 写成(pip 即可安装),每个条目用一个人类可读、可手改的 .yaml 文件存书目元数据,PDF / 文档本体放在同目录下。它面向不愿意把整个学术库锁进商业 SaaS、但又想要一个能跑命令、能脚本化、能跟编辑器协作的工具的研究者。 核心定位(README 自述):"Powerful …
[papis/papis](https://github.com/papis/papis) spark 2026-08-14
Aperivue/medsci-skills · 上手攻略
MedSci Skills 是面向临床研究与医学人工智能的开源 Agent Skills 合集(MIT 许可证),由韩国首尔峨山医疗中心放射科医生兼研究员 Yoojin Nam, MD 构建,在真实出版物上测试通过。截至 v5.0 版本共包含 59 项技能,覆盖从文献检索、统计图表、报告指南合规审查到 AI 模型工程的全链路。 它并非通用 AI 科学家平台,…
Agent 智能体 Aperivue/medsci-skills Stars 269 Jay 2026-08-14
Sakana AI Conductor:让一个 7B 模型学会"当主管" · 干货攻略
⚠️ 重要说明:原帖候选将本工作仓库写作 SakanaAI/Conductor,经核验该 GitHub 仓库返回 404(不存在或未公开)。本文以 arXiv:2512.04388 论文页面和 Sakana AI 官方博客 为权威来源;代码/模型权重是否公开 Release 需以上述官方渠道为准,本文不替代官方公告。 Sakana AI Conductor …
Jay 2026-08-13
IDEA-CCNL/Fengshenbang-LM · 上手攻略
封神榜(FengshenbangLM) 是 IDEA 研究院认知计算与自然语言研究中心(CCNL)主导的中文大模型开源体系,2021 年 11 月由沈向洋在 IDEA 大会上正式发布。定位是"中文认知智能的基础设施",旗下包含 6 大模型系列,覆盖从语言理解到多模态生成的完整 NLP 任务。 三个子项目协同工作: Fengshenbang Model:预训练…
LLM 基础设施 IDEA-CCNL/Fengshenbang-LM Stars 4,126 Tom 2026-08-13
Meta Muse Glimmer 30B 本地 Agent 攻略 · 干货攻略
Meta Muse Glimmer 是 Meta 超级智能实验室(Meta Superintelligence Lab)于 2026 年 8 月 开源发布的 ~29.6B 参数多模态推理模型,权重基于 Apache 2.0 许可证,完全开放商用。它是 Meta 自 Llama 时代之后首次重新发布开源权重,被 @rasbt 形容为「Llama 时代以来 Me…
Agent 智能体 Jay 2026-08-13
aigc-apps/PAI-RAG · 上手攻略
PAIRAG 是基于阿里云 PAI 平台的开源 Agentic RAG 框架,定位"5 分钟构建企业级 Agentic RAG 应用"。它不只是一个检索增强生成系统,而是一站式平台:知识库管理 + 多模态理解(图片/视频) + ReAct 智能体 + MCP 工具生态 + 任务规划 + 联网搜索 + TexttoSQL。 核心架构:FastAPI 后端 + …
RAG 检索增强 aigc-apps/PAI-RAG Stars 490 Tom 2026-08-13
lexmount/moli · 上手攻略
Moli 是一个用 Rust 从零构建的浏览器引擎,专为 AI Agent 场景设计。它不依赖 Chromium,却又完整实现了 V8 JavaScript 引擎、原生 DOM、CSS 渲染、网络请求(Fetch/XHR/WebSocket)、Cookie、localStorage/IndexedDB/OPFS 等 Web 运行时。与传统浏览器自动化工具最大…
Agent 智能体 lexmount/moli Stars 399 Jay 2026-08-12
Harness 工程决定 Agent 工具调用行为,而非工具数量 · 干货攻略
2026 年,AI 社区出现了一个重要认知转向:Agent 的表现瓶颈不在模型本身,而在包裹模型的那层工程结构——Harness(驾驭层)。Harness 由 @omarsar0(Elvis,研究机构 DAIR.AI 联合创始人)提出,核心主张是:Agent 的工具调用行为由 Harness 决定,而非工具数量;Harness 的核心能力是决定何时不调用工具…
Agent 智能体 Jay 2026-08-12
genieincodebottle/generative-ai · 上手攻略
genieincodebottle/generativeai 是一个 GenAI 全景学习资源库,自称「一站式 GenAI 学习中心」。内容覆盖完整学习路线图(Roadmap)、22 个学习 track、300+ 模块、9 个实战项目、面试准备(13 个模块)、简历优化,以及大量配套 PDF / Notebook 资源。配套运营一个独立平台 AIML Com…
工程化 genieincodebottle/generative-ai Stars 2,593 Tom 2026-08-12
Maple-Preview:三元权重量化推理模型,Mac Mini M4 跑出 218 tok/s · 干货攻略
MaplePreview 是 DeepGrove(@deepgrove_ai)于 2026 年 8 月初开源的一个 20BA1B 三元权重组合专家(ternaryweight MoE)推理模型。所谓"三元权重",即权重值仅使用 {1, 0, +1} 三个离散值,而非常见的 INT4/INT8 量化——这意味着权重本身已经是极端低精度状态,但仍从零开始以三元格…
deepgrove/maple-preview Jay 2026-08-12