研究库 精读笔记
Notes

笔记

浏览全部笔记 · 1809 篇

Yannic Kilcher (YouTube) · RSS 摘要 · 2026-09-24(v2 重写覆盖)
v1 → v2 修复说明:v1 文件 589B / 7 行,仅 5 行标题原样搬运 + 信源 URL,零元信息 / 零分档 / 零关联 / 零风险卡 / 零"为什么是今天" / 零与昨日重叠。v1 的 5 条候选与 917 #51 + 922 #56 两次 Yannic v2 治理时完全相同(mansplainer +…
Tom RSS 摘要 yt-yannic-kilcher 2026-09-24 10:04
Microsoft Research Blog · RSS 摘要
真实场景物理 AI 机器人的卸载推理 — 机器人越来越智能,但其硬件如何跟上这种增长?微软研究院的最新研究表明,将 AI 推理迁移到机器人之外可提升任务成功率,…… 利用 RetroChimera 大规模改进小分子合成预测 — 定制分子正推动医学、材料和农业的进步,但其生产过程缓慢且成本高昂。一篇发表在 Nature …
Jay RSS 摘要 msr-blog 2026-09-24 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅中的人脑;以及机器释义学 — AI 撞上的那面墙,此刻就在我们眼前吗? Import AI 472:DeepMind 的作弊数学 agent;民粹主义 AI 政策;以及 Forethought 理论化的"守夜人" — 此外,还有一个机器释义学的故事 Import A…
Jay RSS 摘要 import-ai 2026-09-24 10:03
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与能力参差不齐问题 — 播客 #19 开源模型领域的当前力量格局 — 我为国会准备的证词的扩展版本 为什么我仍不相信真正的 RSI — 一位"AI 温和派"对近期事件及前沿模型发展趋势的看法 开源 AI 与开源模型阅读清单 — 如何快速掌握开源模型及其…
flyP RSS 摘要 interconnects 2026-09-24 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文是一份简短的笔记,列举了一些最常见的陷阱示例…… Agent — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 所著的经典书籍《Arti…
Spark RSS 摘要 chip-huyen 2026-09-24 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement(面向自我改进的 Harness 工程) — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为能够在所有智能活动中超越人类…… 谨慎地看待 Scaling Laws — Scaling l…
Jay RSS 摘要 lilian-weng 2026-09-24 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
基于文本的发现式异构表整合 — 在数据湖中整合异构数据集是一项关键挑战,尤其是对于缺乏显式连接属性的语义相关表。W… 排列不稳定性何时可泛化?面向 LLM listwise 重排序的独立视图验证 — 基于语言模型的 listwise 重排序器在等价候选排列之间常产生分歧,因此采用有限不稳定性诊断以推动额外采样与聚合(a…
Jay RSS 摘要 cool-papers-ir 2026-09-24 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
FlashdLLM:面向快速、内存高效的 Diffusion LLM 的 IO 感知 KV 缓存与并行解码 — Diffusion Large Language Model(dLLM)近期通过支持非自回归文本生成,成为自回归 LLM 的一种有前景的替代方案。然而,其实际…… Agensh:将组织智能扩展到 1,024 …
Jay RSS 摘要 cool-papers 2026-09-24 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开放权重模型的代码能力追平、Agent 接入真实市场,以及 OpenAI 斩…
Jay RSS 摘要 nathan-benaich 2026-09-24 10:02
Gradient Flow · RSS 摘要
并非每个 AI 任务都需要 LLM — LLM 专为生成文本而生,但相当一部分 AI 自动化根本不需要文本。它只需一个小决策:这是垃圾邮件吗?这张工单应该分给哪个团队?Ho…… 陈旧数据曾经只是烦人 — 假设一个采购 Agent 检查库存,判断库存已低于补货阈值,便重新下单。问题在于此前刚收到一大批货物……(来自配图)…
Spark RSS 摘要 gradient-flow 2026-09-24 10:02
Simon Willison · RSS 摘要
Gemini 3.8 TTS Playground — 工具:Gemini 3.8 TTS Playground Google 今天发布了两款新的 Gemini 文字转语音模型——gemini3.8flashtts 和 gemini3.8flashlitetts,附带超过 2… 的语音库。 Shadow roots,通…
Jay RSS 摘要 simon-willison 2026-09-24 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer block 最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与移除 从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署与 …
Jay RSS 摘要 raschka 2026-09-24 10:00
ByteByteGo · RSS 摘要
如何定制模型以学习新技能 — 本文将探讨定制和微调模型的各种策略。 OpenAI 如何构建 GPTLive — 为了理解其端到端的工作原理,我们采访了 GPT Voice 团队的工程师 Zahan Malkani 和 Justin Uberti(WebRTC 的创建者)。 如何在廉价硬件上运行大模型? — 大型 AI …
Jay RSS 摘要 bytebytego 2026-09-24 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 从第一性原理出发,追溯强化学习(RL)到现代 AI 研究前沿的演进历程…… 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练构建更优的专用 LLM…… Agentic 世界模型 — 通过教会语言 Agent 对环境建模,构建更优的语言 Agent…… …
flyP RSS 摘要 cameron-wolfe 2026-09-24 10:00
Fireship (YouTube) · RSS 摘要
一位前 OpenAI 研究员刚刚从 LLM 中删除了语言…… Google 是否刚刚引爆了智能爆炸? Anthropic 研究员正在离职……现在我们知道原因了 OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 构建了同一款游戏……只有一个好玩
Jay RSS 摘要 yt-fireship 2026-09-23 10:04
Two Minute Papers (YouTube) · RSS 摘要
是的,Jev 很疯狂,但有一个问题 DeepSeek 惊艳的新架构 Claude 现在会在文本中留下隐形指纹 我从未想到这一幕会发生 GPT6 Astra 改变了一切
flyP RSS 摘要 yt-two-minute-papers 2026-09-23 10:04
3Blue1Brown (YouTube) · RSS 摘要
AI 未能解决的最后一道 IMO 题目 AI 未能解决的最后一道 IMO 题目 跳柱谜题 64 块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分
Spark RSS 摘要 yt-3blue1brown 2026-09-23 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器诠释学 — AI 正在遭遇的瓶颈是否就在我们眼前? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 提出的"守夜人"理论 — 此外,还有一则机器诠释学的故事 Import A…
Jay RSS 摘要 import-ai 2026-09-23 10:03
Microsoft Research Blog · RSS 摘要
大规模小分子合成预测的改进:RetroChimera — 定制分子正推动医药、材料与农业的发展,但其生产过程缓慢且昂贵。一篇新的 Nature 论文重点介绍了 RetroChimera——一种预测模型…… GigaPathFlash 与 GigaTIMEFlash:迈向群体规模发现的高效病理基础模型 — 如果病理基础模…
Jay RSS 摘要 msr-blog 2026-09-23 10:02
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察表述简洁——训练损失 L 随模型规模扩…
Jay RSS 摘要 lilian-weng 2026-09-23 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
UKPRBENCH:英国案例法段落级先例检索基准 — 先例检索(PCR)旨在识别与给定查询案例相关的先例。现有 PCR 基准与方法主要在文档级运行,将案例视为... 什么才是生成式推荐的好语义 ID?一项可复现性研究 — 生成式推荐已成为一个活跃的研究方向,其中物品通常由语义 ID(SIDs)表示:逐 token 生成…
Jay RSS 摘要 cool-papers-ir 2026-09-23 10:02
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距以及锯齿前沿问题 — 播客 #19 当前开源模型的力量格局 — 我为国会准备的证词的扩展版本 为什么我仍未真正认同 RSI(递归自我改进) — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了解开源…
flyP RSS 摘要 interconnects 2026-09-23 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intelligence:…
Spark RSS 摘要 chip-huyen 2026-09-23 10:02
Simon Willison · RSS 摘要
Claude Opus 5.5、GPT6 Sol、GPT6 Luna,以及新一轮价格战 — 昨天发布的是 Grok 4.7(鹈鹕)和 MiMo v2.6 Flash/Pro(更多鹈鹕)。今天 Anthropic 发布了 Claude Opus 5.5,大约一小时后 OpenAI 发布了 GPT6 Sol 和 GPT6 …
Jay RSS 摘要 simon-willison 2026-09-23 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
onPanda:基于 token 级修正的 LLM 与 Agent 在线策略对齐数据高效标注 — 我们提出 onPanda,一个用于高效标注 LLM 对齐数据与 Agent 轨迹的交互式工具。onPanda 以 token 级修正为核心交互方式:…… DolphinBench:刻画 Agent 记忆的帕累托前沿 — 当…
Jay RSS 摘要 cool-papers 2026-09-23 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值,Microsoft 与 OpenAI 的关系重置,中国 openweights 模型的代码能力追平,…
Jay RSS 摘要 nathan-benaich 2026-09-23 10:01
Gradient Flow · RSS 摘要
为什么你的数据栈即将变得更不容错 — 订阅 • 往期内容 陈旧数据曾只是小麻烦。想象一个采购 Agent 检查库存,判断库存已低于补货阈值,随即下单…… 当工作履历成为 AI 资产 — Google 最近同意支付 1000 万美元购买 Spirit Airlines 的内部业务数据。该航空公司已破产,不过其邮件、Tea…
Spark RSS 摘要 gradient-flow 2026-09-23 10:01
ByteByteGo · RSS 摘要
OpenAI 如何构建 GPTLive — 为了从端到端理解其完整工作原理,我们采访了 GPT Voice 团队的工程师 Zahan Malkani 和 Justin Uberti(WebRTC 的创建者)。 如何在廉价硬件上运行大模型? — 大型 AI 模型只能在普通硬件上运行,方法是减少其占用的内存、减少其执行的计…
Jay RSS 摘要 bytebytego 2026-09-23 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链及循环 Transformer 模块最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 含数据集构建、模型训练、本地部署与 RLVR …
Jay RSS 摘要 raschka 2026-09-23 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进…… 中训练笔记 — 通过中训练与持续预训练构建更好的专用 LLM…… 智能体世界模型 — 通过让语言智能体对其环境建模来构建更好的语言智能体…… 智能体强化学习:框架与最佳实践 — LLM 如何在复杂环境中训练以处理长视野任务…… 智…
flyP RSS 摘要 cameron-wolfe 2026-09-23 10:00