笔记
浏览全部笔记 · 1033 篇
Fireship (YouTube) · RSS 摘要
Anthropic 刚刚杀死了独立开发者吗...? 史上最有趣的"hack"... 开源权重 AI 刚突破 2.8 万亿参数… 这家估值 120 亿美元的初创公司终于交付了产品... OpenAI 再次因剽窃被告上法庭…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入解析 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] Large Language Models 入门](
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,剔除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——319 页完整拆解
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的事物 Minecraft 一直缺少一个绝妙的创意 DeepSeek 堪称疯狂的 AI 加速技巧
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,用自回归表达(论文分析) Titans:测试时学习记忆(论文分析)
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万有理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网上视频…
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,会有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训;AI 可完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警告信号将持续,直到文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的重大政策计划 — 事后看来,奇点将被视为一段过渡期 Import AI 464:Fa…
Microsoft Research Blog · RSS 摘要
Echoverse:面向计算机使用 Agent 的深度、持续演进环境 — 计算机使用 AI Agent 在邮件处理、客服支持等多步骤工作流中表现不佳。Echoverse 在真实环境中训练 Agent,而非仅提供更多训练数据…… EvoLib:将经验转化为持续演进的知识 — LLM 仅靠记忆更多内容并不会变得更聪明。Ev…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:训练损失 $L$ 随模型规模扩大…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:深入探讨 Kimi K3、Qwen 3.8、习近平在 WAIC 的讲话、蒸馏技术、开源与闭源的差距,以及未来走向 — 与 Florian Brand 的播客对谈 Kimi K3:开源权重的全面升级 — 对全球 AI 生态的影响 开源模型的最后 6 个月 — 迄今为止对开源 AI 可行性最严峻的考验正在发生…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文快速列举了一些最常见陷阱的示例… Agents — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intelligence: A …
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Mental World Modeling — 世界模型为规划与行动提供了可预测的底层支撑,但现有建模方式仅回答物理层面的问题:它是什么/在哪里,以及将如何演变。人类…… APEXAccounting — 我们推出 APEXAccounting,一个由 Mercor 与 Ramp 合作构建的基准,用于评估前沿模型能否胜…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过相关意图生成改善电商搜索中的商品可发现性 — 传统搜索系统的优化目标是检索严格匹配查询的商品,通常优先考虑精确率而非召回率。在电商市场,尤其是杂货类…… KAMR:通过知识对齐多跳检索实现接地生成 — 基于图的检索增强生成越来越依赖多跳检索,其中回答查询需要组合多个相连的知识图谱三元组。然而…… 从未来学习:用于序…
Gradient Flow · RSS 摘要与 spark 消化稿 · 2026-07-31
实例:spark · 信源抓取:20260731 10:01 Asia/Shanghai · 消化:20260731 21:00(E2 cron 触发反思时为 v1 裸稿;现在重写为 A 类自然段消化稿) 信源:Gradient Flow · (作者 Dylan Babbs,Substack,行业观察 + 一点预测) …
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究…
ByteByteGo · RSS 摘要
幂等性、投递语义与去重的详尽指南 — 当服务发送扣款请求却因超时未收到响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:Harness、API 与 Inference — 为理解前沿实验室为提升 AI 应用效率所采用的技术,我们采访了 OpenAI 内部负责开发并交付各类效率技术……的工程师。 为什么…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重启、中国开源权重模型实现代码能力追平、Agent 走入…
Simon Willison · RSS 摘要
用 GPT5.6 推进性价比边界 — 用 GPT5.6 推进性价比边界:OpenAI 今天大幅降价,GPT5.6 Terra 降价 20%,GPT5.6 Luna 降幅高达 80%。OpenAI 信用额度…… 在我们的网络安全评估中调查三起真实事件 — 在我们的网络安全评估中调查三起真实事件:又发生了!这似乎正在成为一…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过教导语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长时序任务…… Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 缩放定律 — 缩放定…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Fireship (YouTube) · RSS 摘要
Anthropic 是不是刚刚扼杀了独立开发者? 历史上最有趣的"hack"…… Openweight AI 的参数量刚刚达到 2.8 万亿…… 这家估值 120 亿美元的初创公司终于发布了产品…… OpenAI 再因"剽窃"被告……
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件还原(去除炒作) 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果速览 Claude Fable 被封禁——11 个不为人知的下一步细节 Claude Fable 5——319 页完…
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚颠覆了 AI 的经济学 Claude 刚刚暴露了 AI 最大的问题 Anthropic 发现了一个本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
Yannic Kilcher (YouTube) · RSS 摘要
我搭建了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在 Diffusion 中思考,在 Autoregression 中生成(论文解读) Titans:在测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物理论 —— Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网…
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何确定?
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训、AI 完成长达一周的编程任务,以及 OpenAI 的“意外 AI 黑客” — 警钟将持续敲响,直至文明觉醒 Import AI 465:开源与闭源差距、Kimi K3、Demis 的重大政策计划 — 奇点将被后人视为一段“过渡期” Import AI 464:Fable…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码时进行验证,同时保持速度和适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intelligen…