笔记
浏览全部笔记 · 1792 篇
Fireship (YouTube) · RSS 摘要
一个估值 63 亿美元的开源权重模型刚刚被法国打脸了…… PewDiePie 正在释放 AI……而 OpenAI 怒不可遏 那条真正能让你赚钱的 OpenAI 公告…… 一个 50 年前的军事机密刚刚解决了 Agent prompt injection ? DHH 已经彻底失控了……
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解决的最后一道 IMO 题目 AI 未解的最后一道 IMO 题目 跳棋钉难题 64 块方糖难题
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] LLM 入门](
Two Minute Papers (YouTube) · RSS 摘要
DeepMind 的新 AI 刚刚破解了生命密码 价值十亿美元的 AI 优势正在消失 Claude Opus 5.5 AI:一次惊人的巨大飞跃 Jev 确实很疯狂,但有个问题 DeepSeek 疯狂的新架构
AI Explained (YouTube) · RSS 摘要
OpenAI Security: Controlling Models is Now ‘Hell’ Opus 5.5:我们离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前所看到的一切 GPT 6 Astra:强到连 OpenAI 都开始担忧 [Sam Altman:"2026 年实现 AGI",而模…
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、ECT、额叶切除术、弗洛伊德与荣格 | Lex Fridman 播客 #502 DHH:编程的未来、AI、Agentic Engineering、Vibe Coding 与 Linux | Lex Fridman 播客 #501 Khabib Nurmagomedov:达吉斯坦、MMA、UF…
Yannic Kilcher (YouTube) · RSS 摘要
我搭了一个全自动"爹味说教"生成器 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体扩展;Google DeepMind 为生物学添加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战…
Microsoft Research Blog · RSS 摘要
Agent Lightning v1.0: A 3,500Line Lightweight Agentic RL Framework for Training Agents with Real Harnesses — Training AI agents with reinforcement learning can …
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"ultraintelligent machine"定义为一种能够在……方面超越人类的系统。 Scaling Laws, Carefully — 尺度定律是…
Interconnects (Nathan Lambert) · RSS 摘要
网络风险讨论已陷入困局 — 开源权重、意识形态与权衡取舍 与 Epoch AI 的 JS Denain 探讨 RSI、中美差距与能力锯齿 — 播客 #19 开源模型当前的势力格局 — 我为国会准备的证词扩展版 为什么我仍未真正相信 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开源模…
Chip Huyen · RSS 摘要
构建 generative AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这篇短笔记列举了一些最常见陷阱的示例…… Agent — 智能 agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
文档结构是否有助于稠密检索?两个语料库上四种机制的安慰剂对照消融研究 — 检索增强生成(RAG)系统日益依赖文档结构处理:结构对齐分块、LLM 生成的块上下文、标题路径元数据以及层次… 生成式推荐中漏检目标的训练:将监督信号与概率竞争解耦 — 生成式推荐器返回的候选集规模有限,在重排序前可能遗漏已观测目标。一种训练策略…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
EngramEdit:通过条件记忆实现 LLM 中的解耦式知识更新 — DeepSeek Engram 等条件记忆架构使用输入 ngram 查找学习得到的嵌入,从而在有限额外……的条件下扩展大型语言模型(LLM)的容量 你的提示词应发挥更大作用:检索指令对嵌入模型的影响 — 基于提示的嵌入模型近来受到越来越多的关注,尤…
Nathan Benaich (State of AI) · RSS 摘要
The State of AI Report 2026 — AI building AI, physical AI, booming inference, and escalating cyber risks. 欧洲无法通过租赁的方式实现 AI 主权 — When Washington can disable a mo…
Gradient Flow · RSS 摘要
AI Agent 悄然打破的八项安全假设 — 如果你经常浏览 Ethics.Dev,可能已经注意到 AI Agent 与网络安全最近频繁碰撞。其中一些故事听起来像电影情节:agents…… 我一直在思考这 17,600 次尝试 — 订阅 • 往期内容 AI Agent 悄然打破的八项安全假设 如果你经常浏览 Ethic…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从 BagofWords 到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带关于精度与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — A Look at Recurrent Depth, Hidden Chains of Thou…
ByteByteGo · RSS 摘要
软件边界是开发者最重要的技能 — 本文将介绍一些关键策略,帮助开发者为其正在开发的系统做出正确的边界相关决策。 Netflix 如何训练 LLM 来推荐电影,让你一直看下去 — 本文将介绍 GenRec 的构建过程。 为什么 LLM 会在你犯错时仍然同意你 — 当 LLM 有时会认同错误的说法时,主要是因为其训练过程奖…
Simon Willison · RSS 摘要
ttok 0.4 — 发布:ttok 0.4 ttok 是我用于统计 token 的 CLI 工具,基于 OpenAI 开源的 tiktoken 库。该工具已有两年未更新,但我终于修复了 Click 相关问题…… 引用 Carson Gross — 计算机编程从根本上看涉及两件事:利用计算机解决问题;在解决这些问题的过…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
NVIDIA Nemotron 笔记 — 广泛覆盖最实用的开源 LLM 技术报告系列…… LLM 强化学习:完全指南 — 从第一性原理追溯强化学习演化至现代 AI 研究前沿…… 中训练(Midtraining)笔记 — 通过中训练与持续预训练打造更优的专用 LLM…… 智能体世界模型 — 通过让语言 Agent 建模其…
3Blue1Brown (YouTube) · RSS 摘要
电话号码谜题 AI 未能解出的最后一道 IMO 题目 AI 未能解出的最后一道 IMO 题目 跳木栓谜题 64 块方糖谜题
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析 ChatGPT 等 LLM 复现 GPT2 (124M) 构建 GPT 分词器 [[1小时讲座] LLM 入门](
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的"男性说教"生成器 传统圣诞节直播 传统节日直播 TiDAR:在 Diffusion 中思考,在 Autoregression 中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
精神病学、疯人院、精神疾病、ECT(电休克疗法)、脑叶白质切除术、弗洛伊德与荣格 DHH:编程的未来、AI、Agentic Engineering、Vibe Coding 与 Linux Khabib Nurmagomedov:达吉斯坦、综合格斗、UFC、伊斯兰、Conor、Fedor 与足球 Gary Gallagh…
Microsoft Research Blog · RSS 摘要
Agent Lightning v1.0:一个 3500 行的轻量级 Agentic RL 框架,用于在真实 Harness 下训练 Agent — 用强化学习训练 AI Agent 具有挑战性,因为其工具、上下文和决策由复杂框架管理。Agent Lightning 连接现有…… AI 会错在哪里,失败又能教会我们什么…
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体规模化;Google DeepMind 为生物学内容添加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图式心智空间;太空中的 TPU;Zhipu 启动外层 RSI 循环 — 你能在哪些方面突破 LLM 的能力上限? Import AI 473…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一份简短的记录,列举了一些最常见的陷阱…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intel…
Lilian Weng (Lil'Log) · RSS 摘要
支撑自我改进的工程体系 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将“超智能机器”定义为一种能够在……方面超越人类的系统。 审慎对待缩放定律 — 缩放定律是深度学习中最关键的实证发现之一。其观察结果很简单:随着模型……的扩大,训练损失 $L$ 会呈现可预测的下降趋势。 我们为何思考 …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
面向生成式信息检索的语义 ID 空间的系统性研究 — 生成式信息检索(GIR)已成为一种变革性范式,将文档检索从传统的"检索排序"工作流转向序列到序列…… 解耦生成式检索中的范式、标识符与解码 — 生成式检索通过训练语言模型来生成相关文档的标识符。近期工作将自回归解码器替换为扩散模型,但改变了标识符…… 看见上下文:利…
Interconnects (Nathan Lambert) · RSS 摘要
网络风险议题的讨论已失灵 — 开源权重、意识形态与权衡取舍 与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与前沿模型的锯齿状特征 — 播客 #19 开源模型领域当前的力量格局 — 我为国会准备的证词扩展版 为什么我仍未真正认同 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的观察 开…