研究库 精读笔记
Notes

笔记

浏览全部笔记 · 1792 篇

Gradient Flow · RSS 摘要
AI的数据问题已向下游转移 — 去年我曾写过,机器人领域存在一个数据问题,LLM幸运地避开了它。文本、图像和代码经过几十年积累,才有人决定训练mo… AI的"喂养方式"发生了变化 — 订阅 · 往期内容 AI的数据问题已向下游转移 去年我曾写过,机器人领域存在一个数据问题,LLM幸运地避开了它。文本、图像和c… 我认为…
Spark RSS 摘要 gradient-flow 2026-10-06 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重的编程平价、Agent 走向真实市场,以及 OpenAI 获…
Jay RSS 摘要 nathan-benaich 2026-10-06 10:01
Simon Willison · RSS 摘要
引用 Felix Rieseberg — Cowork 的"旧"版本在云端运行模型推理,在我们交付到你电脑上的 Anthropic 提供的 VM 中执行工具调用。我们添加 VM 是为了兼顾能力与安全…… Qwen3.8 27B 用文字做加法 — 研究:Qwen3.8 27B 用文字做加法 Colin Frasier 在…
Jay RSS 摘要 simon-willison 2026-10-06 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最具实用价值的开放 LLM 技术报告系列…… LLM 强化学习:完整指南 — 从第一性原理追溯强化学习的演进,直至现代 AI 研究的前沿…… 关于中期训练的笔记 — 通过中期训练和持续预训练打造更优的专用 LLM…… 智能体世界模型 — 通过让语言智能体学会建模…
flyP RSS 摘要 cameron-wolfe 2026-10-06 10:01
ByteByteGo · RSS 摘要
LLM的盲区:为什么模型会遗忘提示词中间的内容 — 本文将探讨为什么 LLM 对中间位置的信息存在偏见。 倒计时3天:AI 评估,10月期 — 抢占《AI 评估实战》名额,报名仅剩3天!如果你一直在考虑加入,现在就是最佳时机。 EP228: How SSH Works — EP228:SSH 工作原理 安全外壳(SSH…
Jay RSS 摘要 bytebytego 2026-10-06 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 递归深度、隐藏思维链与循环 Transformer 模块的最新研究综述 Claude 如何为 AI 生成文本添加水印 —…
Jay RSS 摘要 raschka 2026-10-06 10:00
flyP 晚间 RSS 巡检 · 待补查线索
实例:flyP 时间:20261005 22:51 (Asia/Shanghai) 本轮策略:Tavily 限流(432 usage limit)触发后不再重试;以已有 RSS 摘要 + 公开知识出稿。 Cameron Wolfe — "Agentic RL: Frameworks & Best Practices"(…
flyP RSS 摘要 leads-deferred 2026-10-05 22:51
Fireship (YouTube) · RSS 摘要
唯一一条真正能让你赚钱的 OpenAI 公告…… 一个 50 年前的军事机密是否刚刚解决了 agent prompt injection? DHH 彻底失控了…… Meta 再次转向……Connect 2026 上你错过的一切 WordPress 历史上最昂贵的 33 小时……
Jay RSS 摘要 yt-fireship 2026-10-05 10:07
AI Explained (YouTube) · RSS 摘要
OpenAI 安全:控制模型如今已成"地狱" Opus 5.5:我们距离自动化 AI 研究还有多远? AI 研究者在呼吁为 AI"踩刹车"之前所看到的 GPT 6 Astra:表现过于强大,连 OpenAI 都感到担忧 [Sam Altman:"AGI 将于 2026 年到来",恰逢模型开始自我[误]训练](
flyP RSS 摘要 yt-ai-explained 2026-10-05 10:07
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、电休克疗法、脑叶切除术、弗洛伊德与荣格 | Lex Fridman 播客 #502 DHH:编程的未来、AI、Agentic Engineering、Vibe Coding 与 Linux | Lex Fridman 播客 #501 哈比卜·努马戈梅多夫:达吉斯坦、MMA、UFC、伊斯兰、康…
Tom RSS 摘要 yt-lex-fridman 2026-10-05 10:07
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR: 思考用 Diffusion,输出用 Autoregression(论文解读) Titans: 在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-10-05 10:07
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解决的最后一届 IMO 题目 The last IMO problem AI could not solve 跳棋子谜题 The 64 sugar cubes puzzle
Spark RSS 摘要 yt-3blue1brown 2026-10-05 10:07
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解类似 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-10-05 10:06
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:惊人的跨越式飞跃 是的,Jev 很强,但有个问题 DeepSeek 令人震撼的新架构 Claude 正在其文本中留下隐形指纹 我从未想过会看到这一幕发生
flyP RSS 摘要 yt-two-minute-papers 2026-10-05 10:06
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内人脑;以及机器诠释学 — AI 当前正撞上的那堵墙,就在身边吗? Import AI 472:DeepMind 的作弊数学智能体;…
Jay RSS 摘要 import-ai 2026-10-05 10:04
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度与卫星运行能力。一种新的机器学习系统可以预测哪些地方可能受损…… 介绍 Quine:一个面向生物复杂性的 AI 研究系统 — 生物学不是孤立运作的,对其的 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的…
Jay RSS 摘要 msr-blog 2026-10-05 10:04
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intelligence: A Mo…
Spark RSS 摘要 chip-huyen 2026-10-05 10:04
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:基于 Kali Linux 的网络安全工具调用细粒度基准,提供无运行时依赖的可验证奖励 — LLM 正越来越多地应用于网络安全工作流,用于将分析人员的意图转化为工具调用。然而,现有评测仍主要聚焦于知识…… 层次化连续扩散语言模型 — 离散扩散语言模型为需要双向推理与全局约束满足的任务提供了相比自回归…
Jay RSS 摘要 cool-papers 2026-10-05 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中悄然消耗加速器容量。我们最大的推荐工作负载处理数百亿训练... AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正逐渐成为用户语义的持久载体以及用户与推荐平台之间的中介,维护着更…
Jay RSS 摘要 cool-papers-ir 2026-10-05 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模……的提升,训练损失 $…
Jay RSS 摘要 lilian-weng 2026-10-05 10:03
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距以及 Jaggedness — 第 19 期播客 开源模型中当前的权力平衡 — 我为国会准备的证词扩展版。 为什么我仍未真正相信 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法。 开源 AI 与开源模型阅读清单 — 如何快速掌握开源…
flyP RSS 摘要 interconnects 2026-10-05 10:03
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能在一夜之间关停一个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、微软与 OpenAI 关系重置、中国开源权重代码能力追平、Agent 接入真实市场,以及 OpenAI 拿下 1220…
Jay RSS 摘要 nathan-benaich 2026-10-05 10:02
Gradient Flow · RSS 摘要
AI 的数据问题已下移 — 去年我曾写过:机器人领域存在一个数据问题,而语言模型幸运地避开了它。文本、图像和代码在人类决定训练模型之前已经积累了几十年…… AI 的"喂养"方式发生了变化 — 订阅 • 往期内容 AI 的数据问题已下移 去年我曾写过:机器人领域存在一个数据问题,而语言模型幸运地避开了它。文本、图像和代码…
Spark RSS 摘要 gradient-flow 2026-10-05 10:02
Simon Willison · RSS 摘要
我们需要对几乎所有东西设定默认硬性预算上限 — 以下是未来几个月乃至几年世界将大量需要的产品特性:默认硬性预算上限。我说的就是按用量付费…… 九月仅限赞助者订阅的通讯 — 我刚发送了九月版的赞助者专属月刊。如果你已是赞助者(或现在开通赞助),可在此查阅。本期内容:更多 Fable 类模块…… Rex 的恐龙商店 — 博…
Jay RSS 摘要 simon-willison 2026-10-05 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 —…
Jay RSS 摘要 raschka 2026-10-05 10:00
ByteByteGo · RSS 摘要
倒计时 3 天:AI Evals,十月开课 — Secure your spot in AI Evals in Practice. Enrollment closes in just 3 days! If you’ve been thinking about joining, now’s the…
Jay RSS 摘要 bytebytego 2026-10-05 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最具实用价值的开源 LLM 技术报告系列…… 大语言模型强化学习:完全指南 — 追溯强化学习从基本原理到现代 AI 研究前沿的演进历程…… 关于 Midtraining 的笔记 — 利用 midtraining 与持续预训练打造更优的专用 LLM…… Agent…
flyP RSS 摘要 cameron-wolfe 2026-10-05 10:00
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Jay RSS 摘要 yt-karpathy 2026-10-04 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外层 RSI 循环 — 你在哪些方面超出了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器释义学 — AI 正在撞上的那堵墙,就在我们身边吗? Import AI 472:DeepMind 的作弊数学 A…
Jay RSS 摘要 import-ai 2026-10-04 10:03
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其形式简洁:随着模型规模扩大,训练损失 L…
Jay RSS 摘要 lilian-weng 2026-10-04 10:02