笔记
浏览全部笔记 · 1013 篇
AI Explained (YouTube) · RSS 摘要
AI 正在变得有些失控 GPT6 失控?HuggingFace 事件,去除炒作后的真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁 —— 关于下一步的 11 个低调细节
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman Podcast #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Le…
3Blue1Brown (YouTube) · RSS 摘要
跳钉难题 64块方糖难题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析 ChatGPT 等 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚跨越了一条界限 DeepMind 刚刚改变了 AI 看世界的方式 十亿美元级 AI 竞赛格局突变 另一个 DeepSeek 时刻已经到来
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究者 Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立了新基准,并凸显了增强空间推理能力的新机…… Introducing CAREX: Towards Clinically Useful Radiology VLMs with Auxil…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
展示份额预测:排序系统的离线评估任务 — 离线评估是在 A/B 测试中对排序模型进行在线评估之前的主要关卡。标准离线指标衡量预测准确度,但仅是……的替代指标 UniDot:大规模推荐中用于序列建模与特征交互的统一网络 — 工业推荐系统依赖两大在很大程度上独立发展的模型族:多字段用户/物品特征上的特征交互模型,以及序列模…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯到 I. J. Good(1965),他将"超智能机器"定义为一种在……方面超越人类的系统 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式很简单:随着模型……规模的扩大,训练损失 …
Interconnects (Nathan Lambert) · RSS 摘要
教大家如何自力更生获取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何跟上前沿步伐 — 提示:这其实并不是一个蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久才能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得…
Chip Huyen · RSS 摘要
构建生成式 AI 应用的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错是正常的。这篇短文列举了一些最常见的陷阱示例…… Agent(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Intelligence:…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重启、中国开放权重模型实现代码能力对等、Agent 走入真实市场,以及 O…
Simon Willison · RSS 摘要
Mojo🔥 现已开源 — Mojo🔥 现已开源 Mojo🔥 现已开源 Mojo 编程语言自 2023 年 5 月起就承诺会开源,上周发布了 1.0 版本,今天… Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上得分 52 — Qwen 3.8 27B 在 A…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
走向计算溯源:在生成文本中携带因果状态证据 — 语言模型的输出本身无法提供关于其内部计算过程的可验证证据。我们研究计算溯源:生成文本…… 模型催眠:通过叠加式潜意识效果对 AI 实现强控制 — 我们证明 AI 模型普遍容易受到一种我们称为"模型催眠"的现象影响——prompt 中单独看来微弱且看似无关的线索可被系统地……
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Notes on Midtraining — 通过 midtraining 与持续预训练打造更优专用 LLM… Agentic World Models — 通过教会语言 Agent 对环境建模来打造更优语言 Agent… Agentic RL: Frameworks and Best Practices — LLM …
Gradient Flow · RSS 摘要
模型或许并非最大的风险 — 订阅 • 往期内容 最大的 AI 风险存在于模型之外 目前最能揭示问题的 AI 失败案例,并非模型变得过于强大,而是一些…… AI 如何改变数学研究 — 鉴于最近 AI 系统解决研究型数学问题的诸多新闻,我决定更新一篇早先撰写于此的文章。除了编程和 pr…… 持续学习正以零散方式到来 — 之…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 端到端项目:涵盖数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案…
ByteByteGo · RSS 摘要
专为定制而生的美国新型 AI 模型 — 本文将逐一解析 Thinking Machines 在构建 Inkling 过程中的各项技术选型。 Waymo vs 特斯拉:自动驾驶汽车的两条技术路线 — 本文将逐一解析这两种技术路线。 EP222:什么是 Google 的 TPU? — TPU(Tensor Processi…
Fireship (YouTube) · RSS 摘要
这家新初创公司可以查询你去过的任何地方…… Meta 的新模型想要"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更夸张 存储比特币最安全的方式刚刚被攻破…… Anthropic 是否刚刚扼杀了独立开发者……?
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,抛开炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封——关于下一步的 11 个细节
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞节直播 传统节日直播 TiDAR: 扩散中思考,自回归中表达(论文解读) Titans: 测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 究竟什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何知道?
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解类 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚跨过了一条界线 DeepMind 刚刚改变了 AI 感知世界的方式 十亿美元级 AI 竞赛刚刚破局 另一个 DeepSeek 时刻已经到来
Import AI (Jack Clark) · RSS 摘要
Import AI 469: 科学 AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究者 Import AI 468: 23 个 RSI 想法;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互作用 — 你会选择哪个星系? Import AI 467: 自…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 理解拓扑关系设立了新基准,并凸显了增强空间推理能力的新机遇 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正在超越报告生成。CAREX 探索一种统一方…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的经验性发现之一。其观察形式很简单:随着模型规模扩大,训练损…
Interconnects (Nathan Lambert) · RSS 摘要
教大家"为 token 而渔" — Nvidia 希望你自建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏(distillation)的故事。 我写了一本 AI 教科书——AI 多久能做得比我更好? — 关于 AI 写作能力的反思,以及 …
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于使用基础模型构建应用仍处于早期阶段,犯错在所难免。本文简要列举了一些最常见的陷阱示例…… Agent — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Intelligence: A M…