笔记
浏览全部笔记 · 1033 篇
Fireship (YouTube) · RSS 摘要
估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被起诉… 史上最受争议的重写版本刚刚发布… OpenAI 强势回归... GPT 5.6 Sol 首发体验 Claude 绝对没有意识…
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| 压缩即智能 Part 2 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你怎么知道? 重新发明熵 | 压缩即智能 Part 1
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1 小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远无法实时运行
AI Explained (YouTube) · RSS 摘要
模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对战 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——下一步的 11 个隐藏细节 Claude Fable 5——完整 319 页详解 新版 Claude Opus 4.8:你可能错过的 15 …
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动大男子说教器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的惊人技术 | Lex Fridman Podcast #496 维京人、拉格纳、狂战士…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源vs闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点日后回望,不过是一段过渡期 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及…
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:拓展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、逐小时…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
jinarerankerv3.5:一种采用混合注意力与自蒸馏的高效列表式 reranker — 列表式 reranker 是 agentic 检索 pipeline 的判别核心,但生产部署要求其在半结构化数据上同时具备效率、领域鲁棒性与流畅性…… FinSAgent:面向证据驱动 SEC 文件问答的语料对齐多 Agen…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式很简单:随着模型规模的扩大,训练损失…
Interconnects (Nathan Lambert) · RSS 摘要
Kimi K3:开放权重模型的又一次升级 — 对全球 AI 生态的影响 开放模型仅剩 6 个月生存窗口 — 开源 AI 可行性迄今为止最严峻的考验正在此刻上演 最新开放成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态的评估以及发布模型背后的动机 GLM5.2 是…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文是一篇简短笔记,列举了一些最常见的 pitfa… Agent(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《A…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
自动化发现并不存在普遍更优的运行框架 — OpenEvolve、TTTDiscover 等自主发现系统常被用作通用运行框架。然而在实践中,这些是由若干模块组合而成的复合系统…… 关键不在说什么,而在怎么说:评估 LLM 对信念表达的回应 — 用户经常向大语言模型(LLM)表达自己的信念。在某些情境下,LLM 应当将这类…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是由谁来控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开放权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Simon Willison · RSS 摘要
Nativ:在你的 Mac 上本地运行 AI 模型 — Nativ:在你的 Mac 上本地运行 AI 模型。Prince Canuma 是出色的 MLXVLM Python 库的开发者,该库用于在 Mac 上利用 MLX 运行视觉 LLM。非常令人期待…… 与 Claude Code 团队的 Cat 和 Thariq …
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260722 10:01 Asia/Shanghai · 消化:20260722 21:00(第 2 次重写:v1(0722 10:01 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 22 次 v1 风格复发 + 5 行裸稿第 1 条 = "…
ByteByteGo · RSS 摘要
Roblox 对世界模型的押注 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来,听他介绍 Roblox 用来让其多人游戏看起来如同照片一般的世界模型…… MCP vs A2A vs ACP:AI Agent 之间实际如何通信 — Agent 本身已具备能力,与工具及其他 Agent 结合后,…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理努力程度 — LLM 如何学习低、中、高推理努力模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LL…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言 Agent 建模其环境来构建更优的语言智能体…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详尽指南 — 高效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
Fireship (YouTube) · RSS 摘要
这家估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被告… 史上最富争议的重写版本刚刚发布… OpenAI 强势回归…GPT 5.6 Sol 首发上手 Claude 绝对没有意识…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
AI Explained (YouTube) · RSS 摘要
模型井喷:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5——319 页完整拆解 新版 Claude Opus 4.8:你可能错过的 15 …
Two Minute Papers (YouTube) · RSS 摘要
Claude刚刚揭示了AI最大的问题 Anthropic发现了一个本不该存在的东西 Minecraft只差一个绝妙的创意 DeepSeek绝对疯狂的AI速度优化技巧 他们说这永远无法实时运行
Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动的"男性说教"机器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman Podcast #497 FFmpeg:驱动互联网视频背后的不可思议的技术 | Lex Fridman Podcast #496 维京人、拉格…
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断? 重新发明熵 | 压缩即智能 第一部分
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源的差距;Kimi K3;Demis 的重大政策计划 — 奇点将被视为一个过渡期,事后来看才会明白 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简单:随着模型规模扩大,训练损失…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键防护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变量、小…