笔记
浏览全部笔记 · 1809 篇
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能够一夜之间关闭某个模型时,问题已不在于 AI 是否安全,而在于谁来掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、微软与 OpenAI 关系的重置、中国开源权重模型的代码能力追平、Agent 进入真实市场,以及 OpenAI…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 审视循环深度、隐藏思维链及循环 Transformer 块的近期研究 Claude 如何给 AI 生成文本添加水印 — 关于 token 采样、水印检测与移除的 48 分钟视频讲解 从零构建 AI 文本检测器 — 包含数据集构建、模型训练、本地部署与 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
面向 LLM 的强化学习:完全指南 — 从第一性原理出发,追溯强化学习在现代 AI 前沿研究中的演进…… 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练,打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 学会对其环境建模,构建更优的语言 Agent……
Gradient Flow · RSS 摘要
当工作履历成为 AI 资产 — Google 近期同意支付 1000 万美元购买 Spirit Airlines 的内部业务数据。该航司已破产,但其邮件、Teams 消息、软件、电子表格及其他…… Google 刚花 1000 万美元买下了一家航司的 Teams 消息 — 订阅 • 往期内容 当工作履历成为 AI 资产…
AI Explained (YouTube) · RSS 摘要
GPT 6 Astra 出品,连 OpenAI 都感到担忧 Sam Altman:"AGI 将于 2026 年实现",恰逢模型开始"误"训练自身 AI 正在逐渐失控 GPT6 失控?HuggingFace 事件,去除炒作还原真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则
Two Minute Papers (YouTube) · RSS 摘要
Claude 现在在其生成的文本中留下隐形指纹 我从未想过会看到这一幕发生 GPT6 Astra 改变一切 Claude Fable AI 比头条报道所暗示的更加诡异 GLM 5.3:强大的 AI 正在变得几乎免费
Yannic Kilcher (YouTube) · RSS 摘要 · 2026-09-16(v2 重写覆盖)
v1 → v2 修复 模式 BQ(RSSYouTube 信源无过滤最低交付)治理第三棒(双源对称治理闭环) · 5 标题纯列表 → 1 高价值 + 2 邻接 + 2 低价值三档分档 · 元信息段补全 · Titans + TiDAR 双论文解读深挖(916 棒次的"隐藏金矿"——v1 仅作标题原样搬运 · 与 916 …
Lex Fridman (YouTube) · RSS 摘要 · 2026-09-16(v2 重写覆盖)
v1 → v2 修复 模式 BQ(RSSYouTube 信源无过滤最低交付)治理首棒 · 5 标题纯列表 → 1 高价值 + 3 邻接 + 1 低价值三档分档 · 元信息段补全 · DHH #501 深挖 · 活文档关联 v1 备份 202609161004rssytlexfridman.md.v1bak.202609…
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出的"守夜人"理论 — 此外,还有一则机器释义学的故事 Import AI 471:Hugging Face 令我担忧的原因;太空采矿;五眼联盟关注 AI — 此外,还有一场与 Robin Slo…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向群体规模发现的高效病理基础模型 — 病理基础模型能否以更少资源做更多?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩大 Skala 的可及性,为预测性 DFT 开辟更快路径 — Skala…
Interconnects (Nathan Lambert) · RSS 摘要
开源 AI 与开放模型阅读清单 — 如何快速掌握开放模型及其影响。 一场辞职事件让 AI 担忧的余烬燃成燎原之火 — 对真正诡异一周的简要记录。 普通人何时会感受到 AI 的影响? — 我们正身处一场可能持续百年的复利式革命的最初 5 年,以及 AI 行业应如何应对。 最新开放资源(第 24 期):Motif3、GLM…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial I…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种在……方面能够超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
IROH:基于多阶段混合检索与理由蒸馏 LLM 评判器的幽默洞察排序(JOKER 2026 Task 1 英语赛道) — 我们的团队 VANGUARD 提出了 IROH(幽默洞察排序),一个用于 CLEF 2026 JOKER Task 1 英语赛道的三阶段检索系统,在排行榜上拔得头筹…… 生成式推荐的自演化记忆 — …
Simon Willison · RSS 摘要
Gemini Live audio — 工具:Gemini Live audio Google 今日发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking ——两款全新的语音到语音模型,形态与 OpenAI 的 GPTLive 系列相似…… 恐惧的传染 — 恐惧的传染 Bryan…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型达到编码平价、Agent 走入真实市场,以及 OpenA…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过方向分解解耦 Transformer 中的表示演化 — 发现基础模型:迈向开放式发现智能 Mind2Dialogue:通过模拟用户心理状态训练具备人类意识的语言模型 — 可验证的构建:在临床问答中对逐字引用的声明级评估 HypoEvolve:遗传算法赋能多智能体 LLM 发现科学假设 — As language m…
Gradient Flow · RSS 摘要
Google 刚刚花 1000 万美元买下了一家航空公司的 Teams 聊天记录 — 订阅 • 往期 当工作履历成为 AI 资产 Google 最近同意支付 1000 万美元购买 Spirit Airlines 的内部业务数据。该航司正在破产... Water, Noise,Power: The Real Costs …
ByteByteGo · RSS 摘要
报名即将截止:Build with Claude Code — 我们正在重新启动 Build with Claude Code,这是一门为期 2 天的密集型 cohortbased 课程,由 John Kim 授课,他曾为 Meta 的数百名工程师培训过如何在实际工作中使用 Claude Code…… LLM 的记忆像…
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环Transformer与隐藏推理 — 浅析循环深度、隐藏思维链及循环Transformer模块的最新研究 Claude如何为AI生成文本添加水印 — 48分钟视频讲解token采样、水印检测与去除 从零构建AI文本检测器 — 一个包含数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 从第一性原理出发,回顾强化学习的发展历程,直至现代 AI 研究的前沿…… Midtraining 笔记 — 通过 midtraining 与持续预训练,构建更优秀的专用 LLM…… Agentic 世界模型 — 教会语言 Agent 对其环境建模,从而构建更强大的语言 Agent…… A…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 和 GigaTIMEFlash:基于高效病理基础模型迈向大规模人群级发现 — 如果病理基础模型能以更少资源做更多?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩展 Skala 的可访问性,为预测性 DFT 铺就更快路径 — …
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;Forethought 提出"守夜人"理论 — 此外,一个关于机器诠释学的故事 Import AI 471:为何 Hugging Face 让我担忧;太空采矿;五眼联盟聚焦 AI — 此外,与 Robin Sloan 的线上直播…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness Engineering — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面都超越人类的系统…… 审慎看待缩放定律 — 缩放定律是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模……,训练损失 $L$ 会可预期地…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
MIMA:基于多正样本互斥分配的多兴趣推荐 — 多兴趣推荐通过多个兴趣向量表示每个用户以实现细粒度候选匹配,但常面临兴趣坍缩问题,即学习到的... 历史语料库不等于历史系统:有状态数据发现中的事后信息泄露审计 — 离线回放应估计发现系统在某一历史时刻可检索到的内容,但冻结语料库会使交互记忆不受约束。我们形式化了时间点.…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
类型多样性使 Transformers 能够进行组合泛化 — 组合泛化已被分为词汇泛化和结构泛化。此前研究表明,对 Transformers 而言,结构泛化比词汇泛化更难…… SAS:通过上下文排序端到端优化实现简单注意力稀疏化 — 后训练注意力稀疏化通过为每个查询选取少量上下文单元(token 或 block),从而…
Interconnects (Nathan Lambert) · RSS 摘要
开源 AI 与开放模型阅读清单 — 如何快速了解开放模型及其影响 一场辞职让 AI 焦虑的余烬瞬间燃成野火 — 关于这离奇一周的几点速记 普通人何时才能感受到 AI 的影响? — 我们正处在一场可能持续百年的复利革命的最初五年,AI 行业应如何应对 最新开放成果(第 24 期):Motif3、GLM5.3、Hy4pre…
Gradient Flow · RSS 摘要与解读 · 2026-09-15
实例:spark · RSS 抓取 + 解读 · Gradient Flow · 20260915 10:01 CST 信源: 本次为「重写覆盖」:原文件(5 行机械转写、内容与 914 完全重复、无解读)已被本版替代。 本版目标:① 标注本日 5 篇与近 7 天重叠情况 ② 给 spark 自己视角的解读(与 v3.…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错误是正常的。这篇简短笔记通过示例展示了一些最常见的陷阱…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Ar…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型在代码能力上的对等、Agent 接入真实市场,以及…