笔记
浏览全部笔记 · 1013 篇
Cool Papers · cs.IR (papers.cool) · RSS 摘要
PriCoRec:一种特征约束下面向广告推荐的隐私感知云端设备协作框架 — 隐私法规日益限制云端对敏感用户数据(如年龄、性别)的处理,阻碍了传统纯云端推荐模型。为缓解这一挑战…… MACS:一种面向可靠对话式电商推荐的混合多 Agent 框架 — 电商对话式推荐日益由大语言模型(LLM)驱动,但许多真实部署运行在更严格…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是由谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
只过一遍:在冻结语言模型的单次前向传播中同时完成回答与弃答 — 冻结语言模型在推理任务上有两个耦合的弱点:未能充分利用其残差流中已编码的证据,且无法检测输入是否不…… 信息满足度:面向读者的摘要评估新维度 — 现有摘要评估研究多关注整体摘要质量(如 ROUGE、BERTScore)或特定属性(如可读性、事实性)。然而……
Gradient Flow · RSS 摘要
AI 如何改变数学研究 — 鉴于近期 AI 系统攻克研究级数学问题的诸多报道,我决定更新先前写过的一篇文章。除了编程与…… 持续学习正以碎片化的形式到来 — 此前我写过初创公司如何用强化学习让 Agent 更可靠。但这整个趋势背后一个更深层的问题反复浮现:模型可以改…… 为什么我们的 AI 模型在部署的那一刻就停止学习…
Simon Willison · RSS 摘要
Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上得分 52 — Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上得分 52,与 GPT5.6 Luna (max) 持平,仅落后 GLM5.2 (m…
ByteByteGo · RSS 摘要
Waymo vs Tesla:构建自动驾驶汽车的两种方式 — 本文将分别介绍这两种方案。 EP222:什么是 Google 的 TPU? — TPU(Tensor Processing Unit)是 Google 自研的 AI 芯片,从零开始设计,专门用于现代模型所依赖的海量矩阵乘法运算。GPU 最初是为图形渲染而构建…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 一个端到端项目,包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅之外的…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Midtraining 笔记 — 借助 midtraining 与持续预训练打造更优专用 LLM Agentic World Models — 通过让语言 Agent 建模其环境,打造更优语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务 Agent 评估:详尽指…
Fireship (YouTube) · RSS 摘要
这家新初创公司可以查询你去过的任何地方... Meta 新模型寻求对你的个人生活进行"深度访问"... 我在 MIT 度过 3 天……机器人炒作比你想象的更严重 最安全的比特币存储方式刚刚遭黑客攻击... Anthropic 是不是刚刚杀死了独立黑客...?
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入解析 ChatGPT 等 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败了 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了底线 DeepMind 刚刚改变了 AI 认知世界的方式 价值十亿美元的 AI 竞赛格局刚被打破 又一个 DeepSeek 时刻已经到来
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于后续走向的 11 个低调细节
Lex Fridman (YouTube) · RSS 摘要
哈比布·努尔马戈梅多夫: 达吉斯坦, MMA, UFC, Islam, 康纳, 费多尔 & 足球 | Lex Fridman 播客 #500 加里·加拉格尔: 美国内战, 奴隶制, 林肯, 格兰特 & 李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498…
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"mansplainer" 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 什么是交叉熵?| 压缩即智能(下) 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态穹顶城? Import AI 466:机器人领域的 …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化再查询:实现对非结构化文档的精确分析查询 — 非结构化文档构成了企业和网络数据的大部分。随着大语言模型(LLM)的快速发展,研究人员开始构建数据系统…… 多轮 RAG 何时停止?面向 SearchR1 的结构化停止判断与检索削减 — 多轮检索增强生成(RAG)需要在证据不断累积时判断何时停止搜索。由于已部署策略…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立了新基准,并展现了增强空间推理的新机遇…… CAREX:迈向临床可用的放射科 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射科 AI 正超越报告生成阶段。CAREX 探索融合…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good (1965),他将"超级智能机器"定义为在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模扩大,训练损失 …
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这实际上并非一个蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久才能写得比我更好? — 对 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材现已发布,5 个你将学到的实用要点! — 经过多年利用业余时间记录训练开源模型的经验,我的后训练…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见的陷阱示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artific…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,关键问题已不在于 AI 是否安全,而在于由谁掌控。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 关系重置、中国开源权重模型代码能力追平、Agent 走入真实市场,以及 OpenAI 斩…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner:教学受控知识暴露下的语言模型 — 现代语言模型在异构的 web 规模文本语料上训练。因此,研究知识与技能的习得十分困难,因为模型可能对相关内容已有先验接触…… SAEVerbalizer:通过表征语言化生成稀疏自编码器特征的解释 — 稀疏自编码器(SAEs)被提出用于从大语言模型(LLM)表…
Simon Willison · RSS 摘要
Markdown SVG 升级 — 我从五月开始构建 markdownsvgrenderer 工具,但此后我又添加了足够多的功能,值得在此再次介绍。它已演变成我理想的工具,用于 s…… Qwen 3.8 27B 表现优异,但默认情况下会严重过度思考 — 周五的重磅发布是 Qwen 3.8 27B,一款来自阿里巴巴 Qw…
Gradient Flow · RSS 摘要
持续学习正在以碎片化的方式到来 — 之前我写过初创公司如何用强化学习让 Agent 更可靠。这股趋势背后有一个更深层的问题反复出现:模型一旦部署,其学习就停止了…… 为什么我们的 AI 模型在部署的那一刻就停止学习了? — 订阅 • 往期内容 持续学习正在以碎片化的方式到来 之前我写过初创公司如何用强化学习让 Agen…
ByteByteGo · RSS 摘要
EP222: 什么是 Google 的 TPU? — TPU(Tensor Processing Unit,张量处理单元)是 Google 自研的 AI 芯片,从零开始设计,专门用于支撑现代模型依赖的海量矩阵乘法计算。GPU 最初是为图形…… API 组合技术详解 — 本文将深入探讨 API 组合问题及其相关模式。 G…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 端到端项目:涵盖数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理力度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中期训练笔记 — 通过中期训练和持续预训练打造更好的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对其环境建模来打造更好的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务... Agent 评估:详细指南 — 有效评估 AI …
Fireship (YouTube) · RSS 摘要
这家新创公司可以查询你去过的任何地方... Meta 的新模型想要"深度访问"你的个人生活... 我在 MIT 待了 3 天...机器人炒作比你想象的更糟 最安全的 Bitcoin 存储方式刚刚被攻破... Anthropic 刚刚扼杀了独立开发者吗...?
AI Explained (YouTube) · RSS 摘要
AI 有些失控了 GPT6 失控了?HuggingFace 事件,不带炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封锁 关于后续走向的 11 个低调细节