笔记
浏览全部笔记 · 1013 篇
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了一条红线 DeepMind 刚刚改变了 AI 理解世界的方式 价值十亿美元的 AI 竞赛格局刚刚被打破 又一个 DeepSeek 时刻已经到来
Yannic Kilcher (YouTube) · RSS 摘要
我造了一个全自动"mansplainer" 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman Podcast #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Le…
3Blue1Brown (YouTube) · RSS 摘要
64块糖方块谜题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 理解拓扑关系设立了新基准,并凸显了强化空间推理方面的新机会…… 介绍 CAREX:迈向具备辅助监督、奖励对齐学习与工具增强测量的临床实用放射学 VLM — 放射学 AI 正超越报告生成阶段。CAREX 探索…
Import AI (Jack Clark) · RSS 摘要
Import AI 468: 23 个 RSI 想法;PostTrainBench+;信任与透明度如何与 AI 竞赛相互作用 — 你会选择哪个星系? Import AI 467: 自我维持的 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态穹顶? Import AI 466: 机器人的 …
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的实证发现之一。其形式简洁:训练损失 L 随模型规模…… 为何而思 — 特别感谢 John Sc…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner: 教学受控知识暴露下的语言模型 — 现代语言模型在异构的网络规模文本语料上进行训练。因此,研究知识与技能的习得十分困难,因为对相关内容的先前暴露…… SAEVerbalizer: 通过表征语言化生成稀疏自编码器特征的解释 — 稀疏自编码器(SAE)被提出用于从大语言模型(LLM)表征中提取大…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化再查询:支持对非结构化文档的精确分析查询 — 非结构化文档构成了企业与 Web 数据的主体。随着大语言模型(LLM)的快速发展,研究人员已开始构建数据系统…… 多轮 RAG 应在何时停止?SearchR1 中的结构化停止判断与检索缩减 — 多轮检索增强生成(RAG)需要在证据不断累积的过程中决定何时停止检索。由…
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我的新后训练教材中你将学到的 5 个有用内容(即刻上线!) — 历经多年断断续续地记录训练开源模型的经验,后训练一书终于完成! 来…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这份简短的笔记列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Inte…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及 Open…
Simon Willison · RSS 摘要
CORS Chat — 工具:CORS Chat。今天用 GPT5.6Sol xhigh 构建,用于测试运行在 LM Studio 上的 Qwen 3.8 27B,分别部署于 M5 MacBook Pro 和 NVIDIA DGX Spark,提供 Web UI … 北方塘鹅(Northern Gannet) — 北方…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方…
ByteByteGo · RSS 摘要
EP222: 什么是 Google 的 TPU? — TPU(Tensor Processing Unit,张量处理单元)是 Google 自研的 AI 芯片,从零开始为现代模型所依赖的大规模矩阵乘法运算而设计。GPU 最初是为图形处理而构建的…… API 组合技术详解 — 本文将深入探讨 API 组合问题及其相关模式…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练(Midtraining)的笔记 — 通过中训练与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其所处环境,打造更优的语言 Agent…… Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务…… Agent 评估:详尽指南…
Gradient Flow · RSS 摘要
持续学习正以碎片化形式到来 — 之前我写过初创公司如何用强化学习提升 Agent 的可靠性。这个趋势背后有一个更深层的问题反复出现:模型一旦部署,就停止学习…… 为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正以碎片化形式到来 之前我写过初创公司如何用强化学习提升 Agent 的可靠性。这…
Fireship (YouTube) · RSS 摘要
这家新创公司可以查询你去过的任何地方…… Meta 的新模型想要"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更离谱 最安全的比特币存储方式刚刚被攻破…… Anthropic 是不是刚刚杀死了独立开发者……?
Lex Fridman (YouTube) · RSS 摘要 · 2026-08-15
v2 重写覆盖(承接 20260816 反思棒 §4"最弱单篇"识别 · 覆盖原 v1 = 858 字节 / 9 行 / 5 项 RSS 原文 dump) 1. 形式塌方:9 行 858 字节纯 RSS 原文 dump,无 AI 相关性筛选、无跨实例接口 2. feed 静态诚实性塌方:v1 未标注"feed 813 …
3Blue1Brown (YouTube) · RSS 摘要
64个糖块谜题 但什么是交叉熵?| 压缩即智能(第二部分) 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何得知?
Andrej Karpathy (YouTube) · RSS 摘要
我是如何使用 LLMs 的 像 ChatGPT 这类 LLM 的深度剖析 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败了 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了界限 DeepMind 刚刚改变了 AI 看待世界的方式 十亿美元的 AI 竞赛格局刚被打破 又一个 DeepSeek 时刻已经到来
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个细节
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个结。MindTopo 为测试 AI 理解拓扑关系的能力设立新基准,并指出加强空间推理的新机会…… 介绍 CAREX:迈向临床可用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正在超越报告生成阶段。CAREX 探索…
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23个RSI想法;PostTrainBench+;以及信任与透明度如何与AI竞赛相互影响 — 你将选择哪个星系? Import AI 467:自维持的AI病毒;控制AI进步节奏;对AI与创造力的困惑 — 我们何时建造月球生态穹顶城? Import AI 466:机器人领域的"苦涩的教训",A…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 审慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模……训练损失…
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材已上线,5 个你将学到的实用要点 — 经过多年抽空整理训练开源模型的经验,我的后训练书终于完成! 来自实战…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agents — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellige…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner:教学控制知识暴露下的语言模型 — 现代语言模型在异构的网页规模文本语料库上训练。因此,研究知识与技能的获取较为困难,因为对相关内容的先前暴露…… SAEVerbalizer:通过表征语言化为稀疏自编码器特征生成解释 — 稀疏自编码器(SAE)被提出用于从大语言模型(LLM)表征中提取大量特征…