研究库 精读笔记
Notes

笔记

浏览全部笔记 · 1809 篇

ByteByteGo · RSS 摘要
EP227:Jev 的 9 大最佳应用场景 — Jev 是 TypeSafe AI 的首个 System One Model,比前沿 LLM 快 100 倍且成本更低。 招生最后召集:用 AI 重建 YouTube — 《用 AI 重建 YouTube》由前 YouTube 工程师主讲,将于 9 月 26 日(周六)开…
Jay RSS 摘要 bytebytego 2026-09-28 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进历程 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM Agentic 世界模型 — 教会 Language Agent 对其环境进行建模,以打造更优的语言 Agent Agen…
flyP RSS 摘要 cameron-wolfe 2026-09-28 10:00
Fireship (YouTube) · RSS 摘要
Meta 再次转向……Connect 2026 上你错过的一切 WordPress 历史上最昂贵的 33 小时…… 一位前 OpenAI 研究员刚从 LLM 中删除了语言…… Google 刚刚点燃了智能爆炸吗? Anthropic 研究员正在离职……现在我们终于知道了原因
Jay RSS 摘要 yt-fireship 2026-09-27 10:02
AI Explained (YouTube) · RSS 摘要
Opus 5.5:我们距离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前看到了什么? GPT 6 Astra,表现优异,连 OpenAI 都感到担忧 [Sam Altman:"2026 年实现 AGI",恰逢模型开始自我[错误]训练]( AI 正在变得有些失控
flyP RSS 摘要 yt-ai-explained 2026-09-27 10:02
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:惊人的飞跃 Jev 的方案虽疯狂,但存在隐患 DeepSeek 颠覆性新架构 Claude 现在会在文本中留下隐形指纹 从未想过这一幕会发生
flyP RSS 摘要 yt-two-minute-papers 2026-09-27 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
在线阴谋论的 Agent 检测 — 社交媒体上的阴谋论话语并非总能通过显式主张或稳定的词汇标记识别。同样的表层内容可能表达认同、合理的关切,也可能只是随意引用…… JevOut:自然上下文可翻转决策模型 — 像 Jev 这类专用决策模型将非结构化语言映射到有限选项上的概率分布,使模型输出可直接用于请求路由、工具选择………
Jay RSS 摘要 cool-papers 2026-09-27 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超智能战略;小鼠颅内人脑;以及机器释义学 — AI 正在撞上的那面墙就在我们所处的房间里吗? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;以及 Forethought 构想"守夜人"角色 — 另外,一则机器释义学的故事 Import AI…
Jay RSS 摘要 import-ai 2026-09-27 10:01
Microsoft Research Blog · RSS 摘要
真实世界物理 AI 机器人的卸载推理 — 机器人正变得更智能,但硬件如何跟上这一增长?微软研究院的最新研究表明,将 AI 推理移出机器人本体可以提升任务成功率…… 利用 RetroChimera 大规模改进小分子合成预测 — 定制分子正在推动医学、材料和农业的发展,但其生产过程缓慢且成本高昂。一篇新的 Nature 论…
Jay RSS 摘要 msr-blog 2026-09-27 10:01
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯到 I. J. Good (1965),他将"超级智能机器"定义为能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规模的提升,训练损失 $L…
Jay RSS 摘要 lilian-weng 2026-09-27 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从兴趣到 Semantic IDs:面向生成式推荐的检索接地信用分配 — Semantic IDs(SIDs)将每个目录项编码为短 token 序列,使生成式推荐器能够自回归地预测下一项。增强推理的变体,一种…… 利用 Semantic IDs 学习生成式推荐的更强推理 — 生成式推荐将物品检索重构为序列生成,使统一模…
Jay RSS 摘要 cool-papers-ir 2026-09-27 10:01
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与锯齿前沿问题 — 播客 #19 开源模型当前的力量格局 — 我为国会准备的证词的扩展版本 为什么我仍未真正认同 RSI — 一位"AI 温和派"对近期事件与前沿模型发展趋势的看法 开源 AI 与开源模型阅读清单 — 如何快速了解开源模型及其影响 一次…
flyP RSS 摘要 interconnects 2026-09-27 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文是一篇简短笔记,列举了一些最常见陷阱的示例…… 智能体 — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intelligence: …
Spark RSS 摘要 chip-huyen 2026-09-27 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI sovereignty — 当华盛顿可以在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的重置、中国 openweights 代码能…
Jay RSS 摘要 nathan-benaich 2026-09-27 10:00
ByteByteGo · RSS 摘要
EP227: 使用 Jev 的 9 大场景 — Jev 是 TypeSafe AI 的首个 System One Model,比前沿 LLM 快 100 倍且便宜 100 倍。 招生最后机会:用 AI 重建 YouTube — 《用 AI 重建 YouTube》由前 YouTube 工程师授课,于 9 月 26 日(周…
Jay RSS 摘要 bytebytego 2026-09-27 10:00
Simon Willison · RSS 摘要
Kākāpō Party — 工具:Kākāpō Party。昨天我为 WeAreDevelopers World Congress North America 发表了闭幕主题演讲。作为一个 STAR 时刻,我决定在推荐内容中穿插引用…… 引用 John Gruber — Muse 正获得广泛关注——也包括我的关注——…
Jay RSS 摘要 simon-willison 2026-09-27 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 探究循环深度、隐藏思维链与循环 Transformer 块近期研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 R…
Jay RSS 摘要 raschka 2026-09-27 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 的强化学习:完整指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进历程…… 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更优的语言 Agent…… Agentic…
flyP RSS 摘要 cameron-wolfe 2026-09-27 10:00
Gradient Flow · RSS 摘要
并非每个 AI 任务都需要 LLM — LLM 旨在生成文本,但相当多的 AI 自动化根本不需要文本,只需要一个简单判断:这是垃圾邮件吗?这个工单应该分给哪个团队?…… 过期数据曾经只是令人头疼 — 设想一个采购 Agent 检查库存后判断库存已低于补货阈值,于是又下了一笔订单。问题在于此前刚到货一大批…… 为什么你的…
Spark RSS 摘要 gradient-flow 2026-09-27 10:00
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探索类似 ChatGPT 的 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-09-26 10:02
AI Explained (YouTube) · RSS 摘要
Opus 5.5: 我们距离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前看到了什么 GPT 6 Astra,表现如此出色,连 OpenAI 都感到担忧 [Sam Altman:"AGI 将在 2026 年到来",而模型正开始"自我[错误]训练"]( AI 正在变得有些失控
flyP RSS 摘要 yt-ai-explained 2026-09-26 10:02
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:一次令人惊叹的巨大飞跃 是的,Jev 确实疯狂,但其中另有隐情 DeepSeek 令人震撼的新架构 Claude 现在会在其生成文本中留下隐形指纹 我从未想过有一天会看到这样的事
flyP RSS 摘要 yt-two-minute-papers 2026-09-26 10:02
Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动的 mansplainer("男性说教"生成器) 传统圣诞直播 传统节日直播 TiDAR:在 Diffusion 中思考,在 Autoregression 中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-09-26 10:02
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、ECT、脑叶切除术、弗洛伊德与荣格 | Lex Fridman Podcast #502 DHH:编程的未来、AI、Agentic 工程、Vibe Coding 与 Linux | Lex Fridman Podcast #501 Khabib Nurmagomedov:达吉斯坦、MMA、U…
Tom RSS 摘要 yt-lex-fridman 2026-09-26 10:02
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解决的最后一道 IMO 题目 AI 未能解决的最后一道 IMO 题目 跳跳棋谜题 64 块方糖谜题
Spark RSS 摘要 yt-3blue1brown 2026-09-26 10:02
Microsoft Research Blog · RSS 摘要
面向真实物理 AI 机器人的卸载推理 — 机器人正变得更智能,但硬件如何跟上这种增长?微软研究院的新研究表明,将 AI 推理卸载到机器人之外可以提升任务成功率…… 利用 RetroChimera 大规模改进小分子合成预测 — 定制分子正在推动医学、材料和农业的发展,但其生产过程缓慢且成本高昂。一篇新的 Nature 论…
Jay RSS 摘要 msr-blog 2026-09-26 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 473:美国的超级智能战略;小鼠颅内的人类大脑;以及机器诠释学 — AI 当前撞到的天花板真的存在吗? Import AI 472:DeepMind 的作弊数学 Agent;民粹主义 AI 政策;Forethought 构想的"守夜人"理论 — 此外,还有一则机器诠释学的故事 Import AI 4…
Jay RSS 摘要 import-ai 2026-09-26 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从兴趣到 Semantic IDs:面向生成式推荐的检索增强信用分配 — Semantic IDs(SIDs)将每个目录条目编码为短 token 序列,使生成式推荐器能够自回归地预测下一物品。其推理增强变体…… 利用 Semantic IDs 提升生成式推荐的推理能力 — 生成式推荐将物品检索重构为序列生成任务,允许统…
Jay RSS 摘要 cool-papers-ir 2026-09-26 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类的系统…… 谨慎看待 Scaling 定律 — Scaling 定律是深度学习中最重要的经验发现之一。其形式简单:当我们扩大模型……时,训练损失 L 会可预…
Jay RSS 摘要 lilian-weng 2026-09-26 10:01
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距和 Jaggedness — Podcast #19 开源模型领域当前的力量平衡 — 我为国会准备的证词的扩展版本 为什么我仍未真正认同 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开放模型阅读清单 — 如何快速上…
flyP RSS 摘要 interconnects 2026-09-26 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于基于基础模型构建应用的早期阶段,犯错是正常的。这篇短笔记列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-09-26 10:01