笔记
浏览全部笔记 · 1033 篇
3Blue1Brown (YouTube) · RSS 摘要
100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何知道? 重新发明熵 | 压缩即智能 第一部分 随机连接端点:有多少个环?
Andrej Karpathy (YouTube) · RSS 摘要
我是如何使用 LLM 的 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型入门](
AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 受阻——关于下一步的 11 个不为人知的细节 Claude Fable 5——完整 319 页详解 新版 Claude Opus 4.8:你可能错过的 …
Two Minute Papers (YouTube) · RSS 摘要
Claude 的大脑藏着一个秘密……科学家发现了它 Minecraft 缺少了一个绝妙的想法 DeepSeek 令人震撼的 AI 加速技巧 他们说这永远无法实现实时运行 AI 刚刚进入一个新时代
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的"mansplainer" 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及写给人本时代的悼亡式随笔 — 哪些时代框定了我们的过渡期? Import AI 462:超级说服;自我维持的 AI;通往 AS…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学实现:从标准到代码 — 密码学代码为现代计算系统提供关键的安全保障。了解一种新方法如何在开发者编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:扩展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于基于基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agents(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intelligen…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
ViHoRec:一个质量可控的越南酒店推荐数据集与冷启动基准 — 越南语推荐系统研究受限于缺乏公开且文档完善的酒店交互资源。构建此类资源面临三方面的挑战…… RecRec:面向序列推荐的潜在兴趣递归推理 — 序列推荐系统依赖单次前向传播来编码用户交互历史并预测下一项。通过潜在推理增加推理时计算量…… Learning …
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模……的扩大,训…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
PalmClaw:面向手机的原生端侧 Agent 框架 — LLM Agent 已不再局限于生成回复,而是通过调用工具、观察结果并迭代决定下一步操作来执行多步任务…… 鲁棒性的假象:在任务无关上下文下,整体准确率掩盖了预测翻转 — 随着 LLM 能力日益增强,它们被越来越多地部署在上下文丰富的场景中,任务输入常伴随冗长…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型的生死 6 个月 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 最新开源成果(第 22 期):Zyphra、Cohere 与 Poolside 正在拓宽生态边界 — 对开源生态的评估及其模型发布动机解析 GLM5.2:开源 Agent 的跨越式突破 — 一个我一直在密切关注的能力门槛 封禁开源 AI 将…
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260716 10:02 Asia/Shanghai · 消化:20260716 21:00(第 2 次重写:v1(0716 10:02 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 16 次 v1 风格复发 + 含 2 条 Gradient…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的重置、中国开放权重模型的编程能力对等、Agent 接入真实…
Simon Willison · RSS 摘要
Mermaid 转 Unicode 框图(grokmermaid) — 工具:Mermaid 转 Unicode 框图(grokmermaid)。在探索刚开源的 Grok CLI coding agent 代码库时,我在 xaigrokmarkdown/src/mermaid.rs 中发现了一个“se…… xaiorg…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以在复杂环境中处理长周期任务…… Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM Benchmark 的解剖…
ByteByteGo · RSS 摘要
AI 客户支持规模化:旅游业的数十亿美元豪赌 — 本文将从第一性原理出发,沿支持流程逐一剖析各类方案,揭示为何总有一部分长尾用例始终难以被自动化所覆盖…… LLM 如何学会"有用"(RLHF 与 DPO) — 本文将剖析这一学习的真实过程:从单纯的指令遵循为何不足谈起,再依次讲解当前两种主流的训练方法…… 微软如何在企…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地编码 Agent — 在本地编码 Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1—5 月) — 精选汇总本年度值得关注的 LLM 研究论文 LLM 架构最新进展:KV Sharing、mHC 与 Compressed At…
Fireship (YouTube) · RSS 摘要
OpenAI 回归了…GPT 5.6 Sol 首发速览 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有了新的支线任务…死亡 地球上最受信赖的代码正在用 Rust 重写
AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁:关于下一步的 11 个隐藏细节 Claude Fable 5:319 页完整拆解 新版 Claude Opus 4.8:你可能错过的 15 个细…
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网上视频背后的惊人技术 | Lex Fridman 播客 #496 维京人、拉格纳、狂战士、英灵殿与维京时代的战士 |…
3Blue1Brown (YouTube) · RSS 摘要
100 条随机弦,能产生多少个交点? 测量英语的熵 什么是完美编码?如何判断? 重新发明熵 | 压缩即智能(上) 随机连接端点:会产生多少个环?
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Minecraft 缺少的那个绝妙创意 DeepSeek 不可思议的 AI 加速方案 他们说这项技术永远无法实时运行 AI 进入新时代 DeepSeek 破解 AI 的十亿美元难题
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在 Diffusion 中思考,在 Autoregression 中表达(论文解读) Titans:测试时学习记忆(论文解读)
Import AI (Jack Clark) · RSS 摘要
Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? 自我改进的机器人;万卡中国 GPU 集群;以及一篇写给人类时代的悼文 — 哪些时代框定了我们的过渡期? 超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰有多像宗教? "对齐并未走上正轨";FrontierCode;以及合…
Microsoft Research Blog · RSS 摘要
从标准到代码:在 SymCrypt 中验证 Rust 密码学实现 — 密码学代码为现代计算系统提供关键安全防护。了解一种新方法如何在保持速度和灵活性的同时,帮助开发者在编写代码时进行验证…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规…
Interconnects (Nathan Lambert) · RSS 摘要
开放模型只剩 6 个月 — 迄今为止对开源 AI 生存能力最严峻的考验正在发生 最新开放成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态及模型发布背后动机的评估 GLM5.2 是开放 Agent 的重大飞跃 — 我一直密切关注的一项能力阈值 禁止开源 AI 将是…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文是一份简要笔记,列举了一些最常见陷阱的示例…… Agent(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artificial Int…