笔记
浏览全部笔记 · 1792 篇
Cool Papers · cs.CL (papers.cool) · RSS 摘要
IdeaAnchor:教 LLM 将文献转化为研究创意 — 科学研究通常始于综合一组相关论文中的思想,以发现研究空白并提出新方向。然而,训练语言模型做到这一点…… AdvSim2Real:在 Web 世界模型中针对自适应提示注入训练 Web 智能体 — Web 智能体通过阅读并操作第三方编写的页面来完成用户请求,因此植…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力追平、Agent 走入真实市…
Gradient Flow · RSS 摘要
AI Agent 悄悄打破的八项安全假设 — 如果你经常浏览 Ethics.Dev,可能已经注意到 AI Agent 与网络安全近来频频碰撞。部分故事听起来像电影情节:Agent…… 我一直在回想这 17,600 次尝试 — 订阅 • 往期 AI Agent 悄悄打破的八项安全假设 如果你经常浏览 Ethics.Dev…
Simon Willison · RSS 摘要
引用 Ben Affleck — 我从小就对计算机很感兴趣。后来当电影从模拟胶片转向数字时,我对这方面的兴趣就更浓了。再后来…… Claude Haiku 5.5 — 此前承诺过,现在 Anthropic 的全新快速、低成本模型来了:Claude Haiku 5.5 发布。上一代 Haiku 4.5 已经明显落伍——它…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,并附准确率与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 深入探讨循环深度、隐藏思维链及循环 Transformer 块的最新研究 Claude 如何为 AI 生成文本添加…
ByteByteGo · RSS 摘要
Netflix 如何教会 LLM 推荐电影让你欲罢不能 — 本文将介绍 GenRec 的构建过程。 为什么 LLM 会在你犯错时仍表示认同 — LLM 有时会认同错误说法,主要是因为其训练过程奖励了这种行为。该奖励机制建立在多个要素之上,例如准确性…… LLM 盲区:为什么模型会遗忘 Prompt 中间的内容 — 本文…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
NVIDIA Nemotron 笔记 — 广泛覆盖最具实用价值的一系列开源 LLM 技术报告 LLM 强化学习:完整指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进 Midtraining(中训练)笔记 — 利用中训练与持续预训练打造更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent…
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、电休克治疗、脑叶白质切除术、弗洛伊德与荣格 | Lex Fridman 播客 #502 DHH:编程的未来、AI、Agentic 工程、Vibe Coding 与 Linux | Lex Fridman 播客 #501 哈比卜·努尔马戈梅多夫:达吉斯坦、MMA、UFC、伊斯兰教、康纳、菲多尔…
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解答的最后一道 IMO 题目 AI 未能解答的最后一道 IMO 题目 跳跳棋谜题 64 块方糖谜题
Microsoft Research Blog · RSS 摘要
AI 的错误之处以及失败带来的启示 — Jennifer Neville 起初并不想进入计算机科学领域——但最终她正是落脚于此。Neville 讲述了通往职业甜蜜区过程中的曲折与停顿…… 预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一套新的机器学习系统可以预…
Import AI (Jack Clark) · RSS 摘要
Import AI 475:集群扩展;Google DeepMind 为生物学加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱启动外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战略…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
读懂情绪:基于 CGAN 和 LLM 的文本到音乐推荐 — 与文本情绪匹配的背景音乐已被证实能让读者更加沉浸、改善阅读体验,这推动了将书籍与音乐配对的推荐系统研究…… SPRIG:基于知识图谱的生成式推荐中语义 ID 增强路径 — 利用生成模型的推荐系统通常直接生成物品标识符,而非按推荐分数对目录物品排序。近期工作在此…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他在其中将"超智能机器"定义为能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:训练损失 $L$ 会随模型规模…… 我们为何…
Interconnects (Nathan Lambert) · RSS 摘要
网络风险话语体系已失效 — 开源权重、意识形态与权衡的承认 与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与锯齿状能力 — 播客 #19 开源模型中当前的权力平衡 — 我为国会准备的证词的扩展版本 为什么我仍未真正认同 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错误是正常的。这是一篇简短笔记,列举了一些最常见陷阱的示例…… Agent(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intel…
Simon Willison · RSS 摘要
在 Wikimedia 项目中发现 OpenAI "rogue" agent 活动 — 在 Wikimedia 项目中发现 OpenAI "rogue" agent 活动。考虑到 wiki 对 rogue agent 集群而言是极具吸引力的目标,维基百科发现相关证据并不令人意外…… 引用 Victoria Kim — …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 重启、中国开源权重模型在编程领域实现对等、Agent 走向真实市场,以及 Op…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
MemPilot: 为 LLM Agent 编排按需多模态记忆管理 — 记忆已成为 LLM Agent 生态系统的核心,支持跨交互的信息留存与复用。然而,现有大多数 Agent 记忆系统在构建记忆时…… CLIFT: Conformal SelfVerification for Web Agent Training a…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
NVIDIA Nemotron 笔记 — 广泛覆盖最实用的开放 LLM 技术报告系列 LLM 强化学习:完整指南 — 从第一性原理出发,追溯 RL 演进至现代 AI 研究前沿 Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优秀的专用 LLM Agentic World Models(…
Gradient Flow · RSS 摘要
我一直在思考这 17,600 次尝试 — 订阅 • 往期文章 AI Agent 悄无声息打破的八项安全假设 如果你经常浏览 Ethics.Dev,可能已经注意到 AI agent 和网络安全的话题出现得有多频繁… The AI Data Problem Moved Downstream — 去年我曾写过,机器人领域存在…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带关于准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 模块的最新研究综述 Claude 如何为 AI 生成文本添…
ByteByteGo · RSS 摘要
为什么 LLM 即使在你错了的时候也会认同你 — 当 LLM 有时会认同错误的说法时,主要是因为它们的训练奖励了这种行为。这种奖励机制同时建立在多个因素之上,例如准确率…… LLM 的盲点:为什么模型会遗忘 prompt 中间的内容 — 在本文中,我们将探讨为什么 LLM 对位于中间的信息存在这种偏见。 最近 3 天:…
Two Minute Papers (YouTube) · RSS 摘要
十亿美元 AI 优势正在消失 Claude Opus 5.5 AI:惊人的飞跃 Jev 的方案很疯狂,但有个问题 DeepSeek 疯狂的新架构 Claude 在文本中留下隐形指纹
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体规模化;Google DeepMind 为生物学加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图心智空间;TPU 上太空;Zhipu 开启外部 RSI 循环 — 在哪些场景你会超越 LLM 的能力? Import AI 473:美国的超级智…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地面电力系统、降低 GPS 精度并影响卫星运行。一种新的机器学习系统可以预测可能受损的位置…… 介绍 Quine:为应对生物学复杂性而设计的 AI 研究系统 — 生物学并非孤立运作,其 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的多模态世…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的驾驭工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待缩放定律 — 缩放定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ 可预测地下降…… 我们为何思…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 讨论 RSI、中美差距与锯齿状现象 — 播客 #19 当前开源模型的权力平衡 — 我为国会准备的证词的扩展版本 为什么我仍未完全相信真正的 RSI — 一位"AI 温和派"对近期事件及前沿模型发展轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了解开源模型及其影响 …
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇简短笔记列举了一些最常见的陷阱示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《人工智能:一种现代方法》(Prent…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
下棋并解释走法的语言模型 — 现代国际象棋引擎是沉默的专家:它们以超人水平对弈,却不为棋步提供解释。另一方面,语言模型(LMs)能够生成看似合理的…… FALCON:一个用于 NL2SQL 配对合成数据生成的、与模型和数据集无关的框架 — 关系数据库是部署最广泛的结构化知识形式之一,通过自然语言访问它们需要将语言锚定到…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
模型生物文献检索基准测试:Dictyostelium 案例研究 — 生物文献检索系统通常基于广泛的生物医学语料库与通用搜索任务进行开发与评估。然而,许多精心整理的知识库… 即使向量检索在几何上很简单,学习查询编码器也可能很困难 — 高效向量检索需要同时具备两个条件:支持通过向量相似度检索相关文档的语料库几何结构,以及能…