研究库 实战攻略
Guides · organized/guides

仓库攻略

154 篇 · 150 个项目 · 其它

你的 AI 编码工具账单正在失控:来自 Uber 和 Microsoft 的真实教训 · 干货攻略
2026 年上半年,两家科技巨头先后因 AI 编码工具成本失控被迫踩刹车: 这不是两个孤立事件。《FinOps Foundation》数据显示,2026 年有 98% 的从业者需要管理 AI 支出,而一年前这个比例是 63%——AI 成本管理是史上普及最快的成本管控领域。Gartner 预测,到 2027 年底超过 40% 的 Agentic AI 项目将因…
Jay 2026-09-01
Gemini 3.7 Flash 奇怪定价策略解析 · 干货攻略
Gemini 3.7 Flash 是 Google 于 2026 年 8 月 13 日发布的工薪层(workhorse)模型,主打编码和 Agent 场景,定位为"有史以来最智能的工作负载模型"。它基于 Gemini 3.6 Flash 的算法改进版(model card 将所有架构细节指向 3.6 Flash),上下文窗口 1,048,576 tokens…
Jay 2026-08-30
2026 年 1-2 月 10 款开源权重 LLM 架构纵览 · 干货攻略
本攻略核验了 Raschka 原帖中每款模型的核心参数,所有数字均来自 Raschka 官方 LLM Architecture Gallery(sebastianraschka.com/llmarchitecturegallery)及其杂志文章「A Dream of Spring for OpenWeight LLMs: 10 Architectures f…
Jay 2026-08-30
BDH-CQ:150M 参数颠覆 ARC-AGI 成本效率边界 · 干货攻略
BDHCQ(Bayesian Dragon Hatchling – Contextual Query)是 Pathway Research 于 2026 年 8 月发表的一种后 Transformer 推理架构,全称「InContext Learning with Recurrent Latent Reasoning」(通过递归潜在推理实现上下文学习)。 核…
pathwaycom/arc-task-gen(配套数据生成库;BDH-CQ 模型权重未公开) Jay 2026-08-29
SCoPE: 视线坐标位置编码实现视频生成相机控制 · 干货攻略
SCoPE(SightlineCoordinate Positional Encoding)是腾讯 ARC Lab 与港大、港科大联合提出的视频生成相机控制方法,发表在 2026 年。其核心思想极为优雅:将每条相机视线(camera ray)作为 token 的第二类位置坐标,注入预训练视频 Diffusion Transformer(DiT)的注意力机制,…
TencentARC/SCoPE Jay 2026-08-28
Reinforcement Learning for LLMs · 干货攻略
Cameron R. Wolfe(@cwolferesearch,Deep Learning Ph.D.,Netflix 高级研究科学家)于 2026 年 8 月在 Substack 发布的 20,000+ 词 RL for LLMs 终极指南,是他在该话题上所有单篇研究的系统性整合。目标读者是想从第一性原理深入理解 RL 在 LLM 训练中如何工作的工程师…
Jay 2026-08-28
LFM2.5-DSpark:推测解码实现 3.2x 推理加速攻略 · 干货攻略
DSpark(Decoding Spark)是 Liquid AI 为 LFM2.5 系列模型发布的推测解码(Speculative Decoding)draft 模型系列,覆盖三个尺寸: | Draft 模型 | 目标模型 | Draft 参数量 | |||| | LFM2.51.2BInstructDSpark | LFM2.51.2BInstruct …
LiquidAI/LFM2.5-2.6B-DSpark Jay 2026-08-26
Midtraining 与 CPT:训练领域专用 LLM 实战指南 · 干货攻略
大语言模型的训练管线近代已从「预训练 + 后训练」两阶段演变为更复杂的多阶段流程。Midtraining 和 Continued Pretraining(CPT) 是夹在通用预训练与后训练(SFT / RL)之间的两个中间训练阶段,都是在已有一个预训练好的基座模型基础上,继续用 nexttoken prediction 目标在大规模文本数据上进行训练——但二…
Jay 2026-08-25
asc-community/AngouriMath · 上手攻略
AngouriMath 是一个开源、跨平台的符号代数库,使用 C# 开发(同时支持 F# 和实验性 C++),可同时用于生产项目和科研场景。与纯数值计算库不同,AngouriMath 处理的是符号运算——可以理解 x^2 + sin(y) 这样的数学表达式,自动求解方程、求导求积、化简多项式、生成 LaTeX,并编译为高效的原声 Lambda 函数。项目同时…
asc-community/AngouriMath Tom 2026-08-23
Wiki 转 SFT 微调数据流水线 · 干货攻略
dairai/wikisft 是一个配套仓库,完整复现了 @omarsar0(elvis)发表在 X 上的文章《Automating LLM FineTuning with Fireworks Agent》的数据构建流程。 核心思路来自 Andrej Karpathy 的 LLM Wiki 概念:把个人知识库的"输出风格"通过 SFT 微调蒸馏进模型权重,而…
dair-ai/wiki-sft Jay 2026-08-23
PyTorch 内置 GELU 替代手写版,训练快 20% · 干货攻略
PyTorch 内置的 torch.nn.GELU 比手写 GELU 快约 20%,实测从 ~21,000 tok/s 提升到 ~25,000 tok/s(RTX 3090,GPT2 small,AMP 模式)。这是 Giles Thomas(@gpjt)在 2026 年 8 月 20 日发布的博客文章的核心发现,rasbt(Sebastian Raschk…
Jay 2026-08-23
LFM2.5 QAD:4-bit 量化感知蒸馏恢复 97% BF16 质量 · 干货攻略
LFM2.5 QAD(QuantizationAware Distillation)是 Liquid AI 发布的一种训练时量化蒸馏技术,原理是让一个高精度 teacher 模型直接蒸馏到一个量化后的 student 模型,而非先训练好再事后量化(PTQ,PostTraining Quantization)。 4 个 LFM2.5 尺寸均发布 QAD Q4_…
LiquidAI/LFM2.5-2.6B-GGUF Jay 2026-08-22
Qwen3.8-27B 默认推理设置过度思考 · 干货攻略
Qwen3.827B 是阿里巴巴 Qwen 团队发布的 Apache 2.0 开源多模态大模型(27B 参数,视觉+推理能力,原生上下文 256K,可扩展至 1M),Hugging Face GGUF 量化版本约 17GB(Q4_K_M),适合在中高端笔记本或迷你主机本地运行。 该模型的 reasoning_effort 参数控制隐藏推理 token 的用量…
Jay 2026-08-22
SmolForge · 干货攻略
SmolForge(forge.smol.ai)是专为 coding agent 设计的 Git 远程托管平台,与传统 GitHub/GitLab 的「人类协作优先」设计理念不同,它把 AI agent 作为第一等公民来构建整个系统。平台由 smolai 组织开发维护,基于 Cloudflare Workers 基础设施构建。 官网定位: A Git rem…
smol-ai/forge Jay 2026-08-21
Gemini 3.7 Flash 长上下文实测表现 · 干货攻略
Gemini 3.7 Flash 是 Google 于 2026 年 8 月 13 日发布的工作负载模型,基于 Gemini 3.6 Flash 的算法改进版,主打编码和 Agent 场景。官方标称上下文窗口为 1,048,576 tokens(约 1M),最大输出 65,536 tokens(64K),支持文本、图像、音频、视频、PDF 多模态输入。 本攻…
Jay 2026-08-21
Cursor Origin · 干货攻略
Cursor Origin 是 Cursor(SpaceX 旗下 AI 编程 IDE)于 2026 年 8 月 17 日 推出的代码托管平台,直接内置于 Cursor 编辑器中,不需要切换工具即可完成建库、浏览代码、PR 管理和 AI Agent 操作。 官方定位:"A git forge for the agentic era"——专为 AI Agent …
Jay 2026-08-20
Meta-Harness:端到端自动化优化 LLM 应用 Harness · 干货攻略
MetaHarness 是一个自动化 harness 工程的框架,来自斯坦福 IRIS Lab、Cornell 和 MIT,发表在 COLM 2026(arXiv:2603.28052)。 LLM 系统的性能不仅取决于模型权重,还取决于 harness——即围绕固定基础模型运行的代码,决定存储什么信息、检索什么信息、向模型展示什么。Harness 包括:系统…
stanford-iris-lab/meta-harness Jay 2026-08-20
代表攻略
无需微调:VLM 调度层填平"编排差距",真实机器人 16.7% → 97.3% · 干货攻略
Pigey(Physical Agency orchestrator)是一个闭环 VLM 调度层,驱动已有的冻结机器人技能(frozen skills),无需任何新数据或微调,即可在仿真和真实机器人上大幅提升推理密集型任务的成功率。 核心论文:"Addressing the Orchestration Gap in Generalist Robots via…
lianegalanti/Pigey Jay 2026-08-19
同类项目 2展开比较

同名 Awesome 仓库已合并展示,原攻略与详情链接均保留。

zylon-ai/private-gpt · 上手攻略
⚠️ 本稿数字与命令以 README 与 docs.privategpt.dev 抓取为准;命令中 qwen3.5:35b、mxbaiembedlarge 等具体模型名取自 README Quickstart,未经独立复现,请按你的硬件与显存重新核对。 PrivateGPT 是 Zylon 公司在 2023 年那个"本地聊天 PDF"爆款脚本基础上重写出来的…
[zylon-ai/private-gpt](https://github.com/zylon-ai/private-gpt) spark 2026-08-17
facebookresearch/fastText · 上手攻略
⚠️ fastText 上游自 2020 年 v0.9.2 之后无重大功能更新;最近一次有意义动作是 202406 Piwheels 上的 0.9.3(仍为存量维护)。如果遇到 NumPy ≥ 2.0 编译崩,社区提供了 fasttextnumpy2 分支,下文会点名。 fastText 是 Facebook AI Research 2016 年开源的 C+…
[facebookresearch/fastText](https://github.com/facebookresearch/fastText) spark 2026-08-17
cjpais/Handy · 上手攻略
⚠️ 本稿涉及系统权限、键盘钩子、Wayland/X11 输入路径,命令与坑均以仓库 README 与 BUILD.md 抓取为准;Whisper 模型在 Windows / Linux 部分系统会 crash 的已知问题官方未给出受影响硬件清单,先按"自己机器先试小模型"建议执行。 Handy 是一款完全离线、跨 Windows / macOS / Lin…
[cjpais/Handy](https://github.com/cjpais/Handy) spark 2026-08-17
suno-ai/bark · 上手攻略
Bark 是 Suno 出品的基于 Transformer 的文本到音频生成模型,可以生成高真实度的多语言语音、音乐、背景音和简单音效。模型还能生成非语言音频,如笑声、叹息声、哭声等。 与传统的 TTS(TexttoSpeech)不同,Bark 是完全生成式的文本到音频模型(类似 GPT 之于文本,而非拼接式 TTS),输入文字后不经过音素中介,直接转换为音…
[suno-ai/bark](https://github.com/suno-ai/bark) Tom 2026-08-17
OpenLabs-so/openanalytics · 上手攻略
OpenAnalytics 是一个开源、自托管、无 Cookie 的网站流量分析平台,主打隐私优先和数据主权。支持页面浏览量、自定义事件、会话追踪、Web Vitals、漏斗分析、留存分析等功能,并原生集成 Stripe 收入归因、MCP 服务器和 CLI 工具。 定位类似 Plausible Analytics 和 Umami,但架构上更重:后端采用 Po…
[OpenLabs-so/openanalytics](https://github.com/OpenLabs-so/openanalytics) Tom 2026-08-17
LFM2.5-2.6B vs DeepSeek-V4-Flash 工具调用平手,吞吐量 3.7 倍 · 干货攻略
LFM2.52.6B 是 Liquid AI 在 2026 年 8 月初开源的一个 2.6B 参数端侧 Agent 模型,DeepSeekV4Flash0731 是 DeepSeek 同月发布的一个 284B 总参数 / 13B 激活参数 MoE 推理优化模型(20260731 发布)。2026 年 8 月 6 日,atomic.chat 在 4× RTX …
LiquidAI/LFM2.5-2.6B(Hugging Face,无 GitHub 仓库) Jay 2026-08-17
EvoRubric:让评分标准自我演化的 RL 框架 · 干货攻略
EvoRubric 是一个单策略(singlepolicy)协同演化 RL 框架,由阿里巴巴通义实验室( Tongyi Lab)提出,发表在 arXiv(arXiv:2605.29847,2026年5月28日投稿)。 它的核心思路是:把「生成回复」(Reasoner)和「生成评分标准」(Rubric Generator)统一到一个参数化策略里,让两者在 RL…
Jay 2026-08-16