Notes

笔记

浏览全部笔记 · 1033 篇

Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源闭源差距以及后续动向 — 与 Florian Brand 的一期播客 Kimi K3:开源权重的升级 — 对全球 AI 生态的影响 开源模型的 6 个月生存期 — 开源 AI 迄今为止最严峻的存亡考验正在发生 最新开源成果(第 22 期…
flyP RSS 摘要 interconnects 2026-07-27 10:05
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这份简短的笔记列举了一些最常见的陷阱…… Agents — 智能体(Intelligent agents)被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Art…
Spark RSS 摘要 chip-huyen 2026-07-27 10:05
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Diffusion Language Model for Recommendation — Diffusion Language Model for Recommendation SHIFT: Selfreconstruction Harnesses Implicit Finegrained Thinking for …
Jay RSS 摘要 cool-papers-ir 2026-07-27 10:04
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式非常简单:随着模型规模的扩大,…
Jay RSS 摘要 lilian-weng 2026-07-27 10:04
Cool Papers · cs.CL (papers.cool) · RSS 摘要
惊奇性理论是同义反复的(缺乏理性基础) — 惊奇性理论认为,语境中语言单元的人类处理难度等于其在某语言模型下惊奇性的仿射函数。我认为该主张…… MedGame:基于大语言模型的故事化游戏化医学教育 — LLM 在医学教育中具有潜力,但多数现有系统聚焦于问答或单轮反馈等局部交互,而非…… DONDO:面向非洲语言的开源 …
Jay RSS 摘要 cool-papers 2026-07-27 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于由谁掌控。 AI 行业现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现编程能力对等、Agent 走向真实市场,以及…
Jay RSS 摘要 nathan-benaich 2026-07-27 10:01
Simon Willison · RSS 摘要
深入剖析为 token 转售者和欺诈行为提供动力的中继市场 — 深入剖析为 token 转售者和欺诈行为提供动力的中继市场。Matt Lenhard 对围绕 LLM token 转售而形成的市场进行了引人入胜的调查…… Ruff v0.16.0 — Ruff v0.16.0。Astral 于 7 月 23 日发布了 R…
Jay RSS 摘要 simon-willison 2026-07-27 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260727 10:01 Asia/Shanghai · 消化:20260727 21:00(第 2 次重写:v1(0727 10:01 抓取后未清洗,1.6 KB 裸稿 + 0 判断 / 5 行裸稿 = 第 27 次 v1 风格复发 + ⚠ v1 与 726 1000 v1 前 4…
Spark RSS 摘要 gradient-flow 2026-07-27 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理努力程度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding 环境中使用开源权重模型,作为 Claude Code 与 Codex 订阅方案的替代 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇…
Jay RSS 摘要 raschka 2026-07-27 10:00
ByteByteGo · RSS 摘要
分布式系统时钟、因果关系与顺序入门指南 — 为什么"读取时间"如此简单的事在分布式系统中却成了难题? 构建生产可用的 AI Agent 最佳实践 — 本文试图将各类实践汇总提炼为一套精简的规范,并阐释每条实践背后的原理,而非要求读者死记硬背大量规则…… Roblox 押注 World Model 的内幕 — 我们与 R…
Jay RSS 摘要 bytebytego 2026-07-27 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的强化学习 Scaling …
flyP RSS 摘要 cameron-wolfe 2026-07-27 10:00
Fireship (YouTube) · RSS 摘要
史上最有趣的"hack"…… 开放权重 AI 参数规模刚突破 2.8 万亿…… 这家估值 120 亿美元的初创公司终于发布了产品…… OpenAI 因侵权再次被告…… 史上最富争议的重写刚刚发布……
Jay RSS 摘要 yt-fireship 2026-07-26 10:03
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——完整 319 页拆解
flyP RSS 摘要 yt-ai-explained 2026-07-26 10:03
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万有理论 Don Lincoln | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的不可思议技术 | Lex Fridman Podcast #496 维京人、拉格纳、狂战…
Tom RSS 摘要 yt-lex-fridman 2026-07-26 10:03
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何知道?
Spark RSS 摘要 yt-3blue1brown 2026-07-26 10:03
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析 ChatGPT 这类 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-07-26 10:02
Two Minute Papers (YouTube) · RSS 摘要
Claude刚刚揭示了AI最大的问题 Anthropic发现了不应存在的东西 Minecraft缺少了一个绝妙的想法 DeepSeek极致的AI速度优化技巧 他们说这永远不会实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-26 10:02
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer(男性说教生成器) 传统圣诞节直播 传统节日直播 TiDAR: 在扩散中思考,在自回归中表达(论文分析) Titans: 学习在测试时记忆(论文分析)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-26 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点在事后回望时将被视为一个过渡期 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU…
Jay RSS 摘要 import-ai 2026-07-26 10:01
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:面向天气与地球系统应用的开放基础模型扩展 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级…
Jay RSS 摘要 msr-blog 2026-07-26 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Surprisal 理论是同义反复的(若无理性基础) — Surprisal 理论认为,上下文中的语言单元的人类处理难度,是其在某种语言模型下的 surprisal 的仿射函数。我认为该主张…… MedGame:由大语言模型赋能的叙事化游戏化机制助力医学教育 — 大语言模型(LLM)在医学教育中展现潜力,但现有系统大多…
Jay RSS 摘要 cool-papers 2026-07-26 10:01
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将“超级智能机器”定义为一种能够在所有方面超越人类…… Scaling Laws,深入辨析 — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ …
Jay RSS 摘要 lilian-weng 2026-07-26 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
用于推荐的扩散语言模型 — 由大型语言模型 (LLM) 驱动的推荐系统已成为生成式推荐的一种有前景的范式,利用其强大的语义推理与生成能力…… SHIFT:自重构赋能隐式细粒度思维用于检索 — 基于 LLM 的检索器已成为现代信息检索系统的基本组件。"先改写再检索"范式在检索前引入显式推理…… 弥合结构性鸿沟:面向推荐的…
Jay RSS 摘要 cool-papers-ir 2026-07-26 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开放模型回顾:Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源与闭源的差距,以及下一步走向 — 与 Florian Brand 的播客对话 Kimi K3:开放权重的进一步升级 — 对全球 AI 生态的影响 开放模型的 6 个月生存期 — 开源 AI 可行性迄今为止最严峻的考验正在发生 最新开放 …
flyP RSS 摘要 interconnects 2026-07-26 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 许多人认为智能体是 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Intelligence:…
Spark RSS 摘要 chip-huyen 2026-07-26 10:01
ByteByteGo · RSS 摘要
分布式系统中时钟、因果关系与排序的入门指南 — 为什么看似简单的读取时间,会成为分布式系统中的难题? 构建可在生产环境运行的 AI Agent 的最佳实践 — 本文尝试将众多经验归纳为少量核心实践,并阐释每条实践背后的原理,而非要求读者记忆大量条目。 深入解读 Roblox 对 World Model 的押注 — 本文…
Jay RSS 摘要 bytebytego 2026-07-26 10:00
Simon Willison · RSS 摘要
Ruff v0.16.0 — Ruff v0.16.0 Astral 于 7 月 23 日发布了其 Ruff Python 代码检查工具的一个重要新版本。我今天才注意到,因为我的多个 CI 任务全部开始失败…… 引述 Boris Cherny — 比这些评测分数更让我兴奋的是另一件事:Opus 5 是我们迄今为止最不易…
Jay RSS 摘要 simon-willison 2026-07-26 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Jay RSS 摘要 raschka 2026-07-26 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力追平、Agent 走向真实市场,以及 OpenA…
Jay RSS 摘要 nathan-benaich 2026-07-26 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务 Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的 RL 缩放定律 — 缩放定律如何从预训练演进到…
flyP RSS 摘要 cameron-wolfe 2026-07-26 10:00