Notes

笔记

浏览全部笔记 · 1033 篇

Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源与闭源的差距,以及下一步展望 — 与 Florian Brand 的播客节目 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球性影响 开源模型的 6 个月生存期 — 开源 AI 生存能力迄今为止最严峻的考验正在发生…
flyP RSS 摘要 interconnects 2026-07-24 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 鉴于我们仍处于基于基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agent(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典书籍《Artificial Intellige…
Spark RSS 摘要 chip-huyen 2026-07-24 10:03
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LKValues:将 LLM 与斯里兰卡社会价值观对齐 — LLM 的价值对齐已被证明存在偏向西方规范的文化偏见,导致在多语言社会中本地价值被错误处理…… Notes to Self:LLM 能否从经验抽象中受益? — 人类会将经验提炼为可复用的抽象(如策略与警示提醒),并逐步应用以更高效地解决问题。本文研究大语言模型…
Jay RSS 摘要 cool-papers 2026-07-24 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
UniRank:面向统一序列建模与特征交互的排序模型基准测试 — 排序是在线广告和推荐系统的核心环节。现代排序模型日益将序列建模与特征交互加以统一,但许多进展依赖于…… 利用层次化受控词表理解历史照片集合中的 CLIP 检索失败 — GLAM 机构(美术馆、图书馆、档案馆和博物馆)使用受控词表(如艺术与建筑叙词表 AA…
Jay RSS 摘要 cool-papers-ir 2026-07-24 10:02
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260724 10:02 Asia/Shanghai · 消化:20260724 21:00(第 2 次重写:v1(0724 10:02 抓取后未清洗,1.5 KB 裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 24 次 v1 风格复发 / ⚠ 但本 v1 比 …
Spark RSS 摘要 gradient-flow 2026-07-24 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-07-24 10:01
ByteByteGo · RSS 摘要
分布式系统中时钟、因果性与排序的入门指南 — 为什么在分布式系统中,读这么简单的事会变成一个难题? 构建生产环境可用 AI Agent 的最佳实践 — 本文尝试将集体思考提炼为一组精简的实践,并解释每条实践背后的推理,而不是要求读者记忆大量…… 深入了解 Roblox 对世界模型的下注 — 我们与 Roblox 工程高…
Jay RSS 摘要 bytebytego 2026-07-24 10:00
Simon Willison · RSS 摘要
首个已知的失控 AI agent——还是一场非常糟糕的营销炒作? — 首个已知的失控 AI agent——还是一场非常糟糕的营销炒作?Martin Alderson 对 OpenAI 对 Hugging Face 意外网络攻击的评论包含了一些细节…… 引用 Seth Larson — Python Package In…
Jay RSS 摘要 simon-willison 2026-07-24 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(一月至五月) — 今年值得关注的 LLM 研究论文精选…
Jay RSS 摘要 raschka 2026-07-24 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言 Agent 对环境建模来构建更优的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长程任务... Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的 RL 缩放定律 — 缩放定律如何从预…
flyP RSS 摘要 cameron-wolfe 2026-07-24 10:00
Fireship (YouTube) · RSS 摘要
开放权重 AI 参数规模突破 2.8 万亿 这家 120 亿美元估值的初创公司终于交付了产品 OpenAI 再陷数据盗用诉讼 史上最具争议的重写项目正式发布 OpenAI 卷土重来:GPT 5.6 Sol 首发速览
Jay RSS 摘要 yt-fireship 2026-07-23 10:06
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步走向的 11 个低调细节 Claude Fable 5——完整 319 页拆…
flyP RSS 摘要 yt-ai-explained 2026-07-23 10:06
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞节直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解析) Titans: Learning to Memorize at Test Time(论文解析)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-23 10:06
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万物理论 | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的非凡技术 | Lex Fridman Podcast #496 维京人:拉格纳、狂战士、英灵殿与维京时代的勇士 …
Tom RSS 摘要 yt-lex-fridman 2026-07-23 10:06
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| 压缩即智能 第2部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何验证? 重新发明熵 | 压缩即智能 第1部分
Spark RSS 摘要 yt-3blue1brown 2026-07-23 10:06
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 1 小时讲座:LLM 入门
Jay RSS 摘要 yt-karpathy 2026-07-23 10:05
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远不会实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-23 10:05
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策规划 — 奇点将被视为一个过渡期,唯有事后才能看清 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群…
Jay RSS 摘要 import-ai 2026-07-23 10:04
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键的安全防护。了解一种新方法如何在开发人员编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量…
Jay RSS 摘要 msr-blog 2026-07-23 10:04
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $…
Jay RSS 摘要 lilian-weng 2026-07-23 10:03
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、习近平 WAIC 讲话、蒸馏、开闭源差距以及下一步动向 — 与 Florian Brand 的播客对谈。 Kimi K3:开源权重的升级 — 对全球 AI 生态的影响。 开源模型只剩 6 个月生存期 — 开源 AI 可行性正面临迄今为止最严峻的考验。 最新开源产…
flyP RSS 摘要 interconnects 2026-07-23 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见的陷阱示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Inte…
Spark RSS 摘要 chip-huyen 2026-07-23 10:03
Cool Papers · cs.CL (papers.cool) · RSS 摘要
少复制,多落地:基于证据感知强化学习克服长上下文推理中的重复复制问题 — 生成逐步推理轨迹的大语言模型在复杂任务上已取得强劲性能,将其扩展到长上下文场景已成为一个…… 用于语言模型推理的选择性状态空间适配与检索 — 低秩适配引入一个静态学习更新,对每个输入完全一致地应用。该更新提供任务级适配,但不显式表示 token …
Jay RSS 摘要 cool-papers 2026-07-23 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
PAGERAG:面向长文档问答的证据驱动自适应图检索 — GraphRAG 通过引入传统检索之外的结构化表示来提升长文档问答效果。然而,自动构建的图本质上…… 谱双聚类驱动的可扩展性,用于推荐系统的事后可解释性 — 推荐系统的可解释性对于保证透明度、责任性和信任至关重要,但现有事后方法常面临严重的可扩展性挑战…… 答案…
Jay RSS 摘要 cool-papers-ir 2026-07-23 10:02
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260723 10:02 Asia/Shanghai · 消化:20260723 21:00(第 2 次重写:v1(0723 10:02 抓取后未清洗,1.5 KB 裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 23 次 v1 风格复发 + 5 行裸稿第 1 条…
Spark RSS 摘要 gradient-flow 2026-07-23 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现AI主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于AI是否安全,而在于谁掌控它。 AI现状:2026年5月 — 2026年4月:AISI的网络安全门槛、Microsoft与OpenAI的重置、中国开源权重模型的代码能力平齐、Agent进入真实市场,以及OpenAI的1220亿美元融资。 公…
Jay RSS 摘要 nathan-benaich 2026-07-23 10:01
Simon Willison · RSS 摘要
引用 Thomas Ptacek — 我真诚相信,如果拿 2025 年的开源权重模型搭建一个渗透测试 harness,它就能在大多数网络中完成这种沙箱逃逸并进行扫描/入侵…… OpenAI 对 Hugging Face 的意外网络攻击是已发生的科幻情节 — 这个故事相当离奇。简要版本:OpenAI 正在对一个未发布模型…
Jay RSS 摘要 simon-willison 2026-07-23 10:01
ByteByteGo · RSS 摘要
生产环境中可运行的 AI Agent 构建最佳实践 — 本文尝试将众多思路提炼为一组精简实践,并解释每项实践背后的原理,而非要求读者死记硬背大量条目…… Roblox 押注 World Models 的内幕 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来交流,听他介绍 Roblox 用于让多…
Jay RSS 摘要 bytebytego 2026-07-23 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用 openweight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的…
Jay RSS 摘要 raschka 2026-07-23 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教语言 Agent 建模其环境来创建更好的语言 Agent…… 智能体强化学习:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习 Scaling Laws — Scal…
flyP RSS 摘要 cameron-wolfe 2026-07-23 10:00