笔记
浏览全部笔记 · 1809 篇
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:惊人的跨越式飞跃 是的,Jev 很强,但有个问题 DeepSeek 令人震撼的新架构 Claude 正在其文本中留下隐形指纹 我从未想过会看到这一幕发生
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内人脑;以及机器诠释学 — AI 当前正撞上的那堵墙,就在身边吗? Import AI 472:DeepMind 的作弊数学智能体;…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度与卫星运行能力。一种新的机器学习系统可以预测哪些地方可能受损…… 介绍 Quine:一个面向生物复杂性的 AI 研究系统 — 生物学不是孤立运作的,对其的 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intelligence: A Mo…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:基于 Kali Linux 的网络安全工具调用细粒度基准,提供无运行时依赖的可验证奖励 — LLM 正越来越多地应用于网络安全工作流,用于将分析人员的意图转化为工具调用。然而,现有评测仍主要聚焦于知识…… 层次化连续扩散语言模型 — 离散扩散语言模型为需要双向推理与全局约束满足的任务提供了相比自回归…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中悄然消耗加速器容量。我们最大的推荐工作负载处理数百亿训练... AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正逐渐成为用户语义的持久载体以及用户与推荐平台之间的中介,维护着更…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模……的提升,训练损失 $…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距以及 Jaggedness — 第 19 期播客 开源模型中当前的权力平衡 — 我为国会准备的证词扩展版。 为什么我仍未真正相信 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法。 开源 AI 与开源模型阅读清单 — 如何快速掌握开源…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能在一夜之间关停一个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、微软与 OpenAI 关系重置、中国开源权重代码能力追平、Agent 接入真实市场,以及 OpenAI 拿下 1220…
Gradient Flow · RSS 摘要
AI 的数据问题已下移 — 去年我曾写过:机器人领域存在一个数据问题,而语言模型幸运地避开了它。文本、图像和代码在人类决定训练模型之前已经积累了几十年…… AI 的"喂养"方式发生了变化 — 订阅 • 往期内容 AI 的数据问题已下移 去年我曾写过:机器人领域存在一个数据问题,而语言模型幸运地避开了它。文本、图像和代码…
Simon Willison · RSS 摘要
我们需要对几乎所有东西设定默认硬性预算上限 — 以下是未来几个月乃至几年世界将大量需要的产品特性:默认硬性预算上限。我说的就是按用量付费…… 九月仅限赞助者订阅的通讯 — 我刚发送了九月版的赞助者专属月刊。如果你已是赞助者(或现在开通赞助),可在此查阅。本期内容:更多 Fable 类模块…… Rex 的恐龙商店 — 博…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 —…
ByteByteGo · RSS 摘要
倒计时 3 天:AI Evals,十月开课 — Secure your spot in AI Evals in Practice. Enrollment closes in just 3 days! If you’ve been thinking about joining, now’s the…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最具实用价值的开源 LLM 技术报告系列…… 大语言模型强化学习:完全指南 — 追溯强化学习从基本原理到现代 AI 研究前沿的演进历程…… 关于 Midtraining 的笔记 — 利用 midtraining 与持续预训练打造更优的专用 LLM…… Agent…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外层 RSI 循环 — 你在哪些方面超出了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器释义学 — AI 正在撞上的那堵墙,就在我们身边吗? Import AI 472:DeepMind 的作弊数学 A…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其形式简洁:随着模型规模扩大,训练损失 L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中静默消耗加速器容量。我们最大的推荐工作负载处理数百亿条训练... AgentWebRec: 基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体,以及用户与推荐平台之间的中介,维护…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一种新的机器学习系统可以预测可能发生损坏的位置…… 介绍 Quine:为生物复杂性而设计的 AI 研究系统 — 生物学不是孤立运作的,其 AI 表示也不应该是孤立的。Quine 是一个早期研究项目,旨在创建生物学的…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 对话:探讨 RSI、中美差距与 Jaggedness — Podcast #19 当前开源模型的力量平衡 — 我为国会准备的证词扩展版 为什么我仍不认同真正的 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation models 构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 的细粒度网络安全工具调用基准,提供免运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,被期望将分析师意图转化为工具调用。然而,现有评测侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理和全局约束满足的任务提供了相较自回归生成的优越替代方案…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁掌控它 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编码平价、Agent 落地真实市场,以及 OpenAI 获 …
Simon Willison · RSS 摘要
我们将需要在几乎所有方面设置默认的硬性预算上限 — 这是一项产品功能——未来数月乃至数年世界将对其需求大增:默认硬性预算上限。我所说的就是按用量付费的功能…… 九月赞助者专属通讯 — 我刚刚发出了九月刊赞助者专属月度通讯。如果你是赞助者(或现在立即开始赞助),可在此访问。本期:更多 Fable 课堂…… Rex 的恐龙…
Gradient Flow · RSS 摘要
AI 数据问题已向下游转移 — 去年我曾写道,机器人领域存在一个语言模型幸运地避开了的数据问题。文本、图像和代码经过了几十年的积累,才有人决定训练 mo… AI 的数据供给方式发生了变化 — 订阅 • 往期内容 AI 数据问题已向下游转移 去年我曾写道,机器人领域存在一个语言模型幸运地避开了的数据问题。文本、图像和代码…
ByteByteGo · RSS 摘要
EP228:SSH 的工作原理 — SSH 是一种在不安全网络环境中安全访问远程机器的方法。它从 SSH 客户端到远程机器(SSH server)建立 TCP 连接开始。 为什么状态是软件设计中最难处理的事情 — 本文将探讨为什么状态是软件开发中最难处理的问题,以及开发者可用来管理状态的多种策略。 DoorDash 如…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋到 Jev — RNN、CNN、Transformer 与校准的可视化指南,配有关于准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 块近期研究综述 Claude 如何为 AI 生成文本添加水印 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最实用的开源 LLM 技术报告系列 LLM 强化学习:完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进 关于 Midtraining(中训练)的笔记 — 通过 Midtraining 与持续预训练打造更优秀的专用 LLM Agentic 世界模…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用大语言模型 深入探究像 ChatGPT 这样的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
预测电网面临的太空天气风险 — 极端太空天气事件会损坏地球上的电力系统,降低 GPS 精度并影响卫星运行。一种新的机器学习系统可以预测可能发生损坏的区域…… 介绍 Quine:面向生物复杂性的 AI 研究系统 — 生物学并非孤立运行,对其的 AI 表征也不应如此。Quine 是一项早期研究工作,旨在构建生物学的多模态世…