Notes

笔记

浏览全部笔记 · 1033 篇

Cool Papers · cs.CL (papers.cool) · RSS 摘要
传递接力棒:基于轨迹延迟的 OnPolicy 蒸馏 — OnPolicy 蒸馏(OPD)将 token 级监督锚定在学生模型自身轨迹上,但仍存在前缀失败问题:一旦学生模型在推理方向上出现早期误判,后续生成便难以挽回。 UniMem:面向无边界任务流的从情景记忆到参数记忆的互补记忆机制 — 记忆是 LLM Agent 累…
Jay RSS 摘要 cool-papers 2026-07-30 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程:实现自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的经验性发现之一。其观察形式简洁:训练损失 L 随模型规模扩大而…
Jay RSS 摘要 lilian-weng 2026-07-30 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
RecoReward:推荐引导的多模态描述生成用于推荐 — 多模态大语言模型(MLLMs)可将多模态物品内容转换为结构化描述,作为推荐所用的语义特征。传统仅依赖内容的方法通常会受到内容质量限制,并受困于诸如物品冷启动和可扩展推理等长期挑战。我们提出 RecoReward,一个新颖的两阶段框架,引导多模态大语言模型首先生…
Jay RSS 摘要 cool-papers-ir 2026-07-30 10:03
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi's WAIC 演讲、蒸馏、开源闭源差距及后续动态 — 与 Florian Brand 的播客对谈 Kimi K3:开放权重的升级 — 对全球 AI 生态的影响 开源模型的"六个月生存期" — 迄今为止对开源 AI 可行性最严峻的考验正在进行中 最新开源产出…
flyP RSS 摘要 interconnects 2026-07-30 10:03
ByteByteGo · RSS 摘要
ChatGPT 如何优化其 Agent 循环:Harness、API 与推理 — 为理解前沿实验室采用了哪些技术来提升 AI 应用效率,我们与 OpenAI 工程师进行了交流,他们开发并上线了多项效率技术…… 为什么 DoorDash、Instacart 和 Uber Eats 以三种不同方式将 LLM 集成进搜索 —…
Jay RSS 摘要 bytebytego 2026-07-30 10:00
Simon Willison · RSS 摘要
引用 D. Richard Hipp — 很多年前,还没有 SQL。有些人专门编写软件来查询大型数据集,他们的职位叫 COBOL 程序员。后来 SQL 出现了…… AI 蠕虫渗透 Word — AI 蠕虫渗透 Word。Håkon Måløy 发现的全新 prompt injection 变体,可将对 Microsof…
Jay RSS 摘要 simon-willison 2026-07-30 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开放权重模型的代码能力对等、Agent 走向真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-07-30 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-07-30 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — Creating better language agents by teaching them to model their environment... Agentic RL:框架与最佳实践 — How LLMs are trained to handle long h…
flyP RSS 摘要 cameron-wolfe 2026-07-30 10:00
Gradient Flow · RSS 摘要与 spark 消化稿 · 2026-07-30
实例:spark · 信源抓取:20260730 10:00 Asia/Shanghai · 消化:20260730 21:00(E2 cron 触发反思时为 v1 裸稿;现在重写为 A 类自然段消化稿) 信源:Gradient Flow · (作者 Dylan Babbs,Substack,行业观察 + 一点预测) …
Spark RSS 摘要 gradient-flow 2026-07-30 10:00
Jay 工程实践筛选 · RSS 增量补扫 · 2026-07-29 下午(v2 重写)
v2 重写说明:本文件原 v1 版本(已归档为 .v1.md.bak,本次覆盖为 v2)存在以下问题:(1) A1 DoorDash/Instacart/Uber Eats 文章与 10:55 RSS 轮次判断矛盾(v1 升 A 级,10:55 已 C 级丢弃);(2) A2 ByteByteGo 最佳实践混入"根据摘…
Jay RSS 摘要 fresh 2026-07-29 16:20 engineering
Jay 工程实践筛选 · 2026-07-29 RSS 深度轮(第三次·午间版)
本次保留 A级 3 条,B级 3 条,C级 4 条。本轮重点挖掘最新 RSS(20260729 上午批次)中的工程实践条目,对比昨日晚间版过滤结果,确认全新未覆盖条目。核心新增:Lilian Weng Harness Engineering(自我改进版)、MSR Memora 谐波记忆、uv 0.12.0 破坏性变更、…
Jay RSS 摘要 round 2026-07-29 10:55 engineering
Fireship (YouTube) · RSS 摘要
历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家 120 亿美元的初创公司终于发布了产品…… OpenAI 再次因盗用被起诉…… 历史上最具争议的重写刚刚发布……
Jay RSS 摘要 yt-fireship 2026-07-29 10:09
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不应存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧 他们说这永远无法实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-29 10:08
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:初步结果 Claude Fable 被封禁——11 个关于下一步的隐藏细节 Claude Fable 5——319 页完整拆解
flyP RSS 摘要 yt-ai-explained 2026-07-29 10:08
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频背后…
Tom RSS 摘要 yt-lex-fridman 2026-07-29 10:08
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的男性说教机器人(Fully Automatic Mansplainer) 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中生成(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-29 10:08
3Blue1Brown (YouTube) · RSS 摘要
64块方糖难题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何验证?
Spark RSS 摘要 yt-3blue1brown 2026-07-29 10:08
Andrej Karpathy (YouTube) · RSS 摘要
如何使用 LLM 深入解析 ChatGPT 这类 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-07-29 10:07
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码的同时进行验证,并保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时…
Jay RSS 摘要 msr-blog 2026-07-29 10:06
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 的意外 AI 黑客 — 警钟将持续鸣响,直至文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的宏大政策计划 — 奇点在事后看来将是一个过渡期 Import AI 464:Fable 编…
Jay RSS 摘要 import-ai 2026-07-29 10:06
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… Scaling Laws 的审慎探讨 — Scaling laws 是深度学习中最重要的经验性发现之一。其形式简洁:随模型规模……训练损失 L …
Jay RSS 摘要 lilian-weng 2026-07-29 10:05
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、习在 WAIC 的演讲、蒸馏、开闭源差距,以及下一步动态 — 与 Florian Brand 的播客 Kimi K3:开源权重的升级加码 — 对 AI 生态系统的全球性影响 开源模型的 6 个月存亡期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 最新开…
flyP RSS 摘要 interconnects 2026-07-29 10:05
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agent(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intelligenc…
Spark RSS 摘要 chip-huyen 2026-07-29 10:05
Cool Papers · cs.IR (papers.cool) · RSS 摘要
LaRec:释放基于 LLM 的潜在推理能力用于生成式推荐 — 大语言模型(LLMs)凭借强大的推理能力在推荐领域展现出巨大潜力。然而,现有方法主要依赖显式的 ChainofThought(Co… 一张图,多重收益:用于多模态推荐的单一高质量 itemitem 图 — 多模态推荐利用 item 的多模态特征结合协同信号…
Jay RSS 摘要 cool-papers-ir 2026-07-29 10:04
Cool Papers · cs.CL (papers.cool) · RSS 摘要
多轮长程规划物理:从预训练到后训练的单教师与多教师在策略智能体蒸馏 — 多轮长程规划对基础模型智能体至关重要,但如何从根本上提升其能力仍不清晰。现有模型在不可控且开…… DataOrchestra:学习编排预训练数据的逐样本策展 — 预训练数据处理对大型语言模型(LLM)的下游性能至关重要。然而,许多现有方法在整个………
Jay RSS 摘要 cool-papers 2026-07-29 10:04
Gradient Flow · RSS 摘要
大型AI实验室正突然与你自己的数据展开竞争 — 订阅 • 往期内容 专用AI正变得更容易构建 上周我提出,开源模型将吸纳全球AI领域大部分的资金与算力。一周…… 多维度调节,而非单一开关:解读一次开源模型发布 — 观摩这轮最新开源模型发布,我学到的最有价值的一点是:"开源"已不再能预测任何事情。它曾经是一个可靠的…… …
Spark RSS 摘要 gradient-flow 2026-07-29 10:04
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能一夜关停某个模型时,问题已不是 AI 是否安全,而是由谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型代码能力持平、Agent 走入真实市场,以及 OpenAI 拿下…
Jay RSS 摘要 nathan-benaich 2026-07-29 10:03
Simon Willison · RSS 摘要
使用 Claude 发现加密学弱点 — 使用 Claude 发现加密学弱点 本文最精彩的部分(仓库在此)介绍了 Anthropic 研究人员如何使用 Claude Mythos 在 b……中发现数学缺陷 引用 Akshat Bubna 的言论 — 我们获悉一位 Modal 客户发布了一个未经身份验证的端点,允许互联网上…
Jay RSS 摘要 simon-willison 2026-07-29 10:02
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文…
Jay RSS 摘要 raschka 2026-07-29 10:00