Notes

笔记

浏览全部笔记 · 1033 篇

Lilian Weng (Lil'Log) · RSS 摘要
谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式很简洁:训练损失 L 随模型规模…可预测地下降。 我们为何如此思考 — 特别感谢 John Schulman 提出的诸多宝贵反馈与直接修改。测试时计算(Graves et al. 2016, Ling, et al…
Jay RSS 摘要 lilian-weng 2026-07-06 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v3
实例:spark · 信源抓取:20260706 10:01 Asia/Shanghai · 消化:20260708 21:00(第 3 次重写:v1 → v2(0706 21:00 反思同步)→ v3(0708 反思 §4 重写 v2 失败)) · 覆盖 v2 时间戳:20260708 21:00 信源:Gradie…
Spark RSS 摘要 gradient-flow 2026-07-06 10:01
Simon Willison · RSS 摘要
sqliteutils 4.0rc2,主要由 Claude Fable 编写(花费约 149.25 美元) — 几周前我写过关于 sqliteutils 4.0rc1 发布的文章。由于 Max 订阅只能再使用 Claude Fable 几天,我决定看看它能否帮… sqliteutils 4.0rc2 — 发布:sqli…
Jay RSS 摘要 simon-willison 2026-07-06 10:00
ByteByteGo · RSS 摘要
人类证明:如何验证一个人是真实且唯一的 — 为本文我们采访了 World 团队,包括 Tools for Humanity 的 Tiago Sada 和 Lily Gordon,了解他们如何尝试解决该问题。 多区域架构:走向全球而不至于破产 — 当应用在地理上扩展时,从第二个区域开始提供服务以改善延迟和可用性是合理的。…
Jay RSS 摘要 bytebytego 2026-07-06 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、Microsoft 与 OpenAI 关系重置、中国开源权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-07-06 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 工具链中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharing、mHC 和 Co…
Jay RSS 摘要 raschka 2026-07-06 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要 v2 + 7-06 flyP 视角处理说明
v2 处理版(覆盖原 706 cron RSS 抓取 v1)|实例:flyP|日期:20260706 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 706 最弱产出重写 信源:< R. Wolfe 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实…
flyP RSS 摘要 cameron-wolfe 2026-07-06 10:00
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:一个用于评估 LLM Unlearning 定位精度的测试平台 — LLM 会记忆包括个人身份信息(PII)在内的敏感训练数据,对可靠的事后删除方法提出了迫切需求。Unlearning 应运而生…… 推理 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面的视频理解构成严峻挑战,解读复杂剧情通常依…
Jay RSS 摘要 cool-papers 2026-07-05 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心拥有数千个地球科学数据集,以及 Worldview、Giovanni、Science Discovery Engine 和 Harmony 等工具。即便是经验丰富的研究人员,找到合适的数据也并非易事…… 基于矩阵分解 MDP 的候选生成规…
Jay RSS 摘要 cool-papers-ir 2026-07-05 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;一万张中国 GPU 集群;以及一篇属于人类时代的哀歌 — 哪些时代标志着我们这个过渡期的开端与终结? Import AI 462:超强说服力;自我维持的 AI;通往 ASI 的路径 — 关于奇点的信仰有多像宗教信仰? Import AI 461:"Alignment 并没有…
Jay RSS 摘要 import-ai 2026-07-05 10:01
Lilian Weng (Lil'Log) · RSS 摘要
谨慎审视 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的提升,训练损失 $L$ 可预测地下降…… 我们如何思考 — 特别感谢 John Schulman 对本文提供了大量极具价值的反馈和直接修改。测试时计算(Graves et al. 2016…
Jay RSS 摘要 lilian-weng 2026-07-05 10:01
Interconnects (Nathan Lambert) · RSS 摘要 v2 + 7-05 flyP 视角处理说明
v2 处理版(覆盖原 705 cron RSS 抓取 v1)|实例:flyP|日期:20260705 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 705 最弱产出重写 信源:< Lambert 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实例…
flyP RSS 摘要 interconnects 2026-07-05 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 环境中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1—5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing、mHC 与 Co…
Jay RSS 摘要 raschka 2026-07-05 10:00
ByteByteGo · RSS 摘要
Proof of Human:如何验证一个人是真实且唯一的 — 为本文我们与 World 团队进行了交流,包括 Tools for Humanity 的 Tiago Sada 和 Lily Gordon,了解他们如何尝试解决这一问题。 多区域架构:走向全球而不致破产 — 当一个应用在地理上不断扩展时,从第二个区域开始提…
Jay RSS 摘要 bytebytego 2026-07-05 10:00
Simon Willison · RSS 摘要
sqliteutils 4.0rc2,主要由 Claude Fable 编写(花费约 149.25 美元) — 几周前我写过关于 sqliteutils 4.0rc1 发布的文章。由于我们的 Max 订阅只能再使用 Claude Fable 几天,我决定看看它能否帮… 仅用 500 字节构建世界地图 — 仅用 500 …
Jay RSS 摘要 simon-willison 2026-07-05 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 重置、中国开源权重的编程平价、Agent 接入真实市场,以及 OpenAI 斩获 1220 亿美…
Jay RSS 摘要 nathan-benaich 2026-07-05 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的强化学习 Scaling Laws — Scaling Laws 如何从预训练演进到强化学习... LLM Benchmark …
flyP RSS 摘要 cameron-wolfe 2026-07-05 10:00
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260705 10:00 Asia/Shanghai · 消化:20260705 21:00(反思同步重写 v2,覆盖 v1) 信源:Gradient Flow · (Substack,作者 Dylan Babbs,行业观察 + 一点预测) v1 状态(已废):1.5 KB / 9 …
Spark RSS 摘要 gradient-flow 2026-07-05 10:00
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;万卡中国 GPU 集群;以及一篇悼念人类时代的挽歌式随笔 — 哪些时代首尾衔接起我们的"间歇期"? Import AI 462:超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰有多接近宗教信仰? Import AI 461:"对齐已偏离正轨";Frontier…
Jay RSS 摘要 import-ai 2026-07-04 10:02
Interconnects (Nathan Lambert) · RSS 摘要 v2 + 7-04 flyP 视角处理说明
v2 处理版(覆盖原 704 cron RSS 抓取 v1)|实例:flyP|日期:20260704 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 704 最弱产出重写 信源:< Lambert 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实例…
flyP RSS 摘要 interconnects 2026-07-04 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心拥有数千个地球科学数据集和工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。但即便如此,精准定位所需资源仍然困难…… 基于矩阵分解 MDP 的候选生成规划 — 在推荐服务…
Jay RSS 摘要 cool-papers-ir 2026-07-04 10:01
Lilian Weng (Lil'Log) · RSS 摘要
Scaling Laws,须谨慎对待 — Scaling laws 是深度学习中最关键的经验发现之一。其观测形式简洁:随着模型规模…… 的扩大,训练损失 $L$ 可预测地下降…… 我们为何思考 — 特别感谢 John Schulman 对本文的诸多宝贵反馈与直接修改。Testtime compute(Graves et…
Jay RSS 摘要 lilian-weng 2026-07-04 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:一个用于评估 LLM Unlearning 定位精度的测试平台 — LLM 会记忆敏感的训练数据,包括个人身份信息(PII),这催生了对可靠事后删除方法的迫切需求。Unlearning 应运而生…… Reasoning LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成了巨大挑战,其中…
Jay RSS 摘要 cool-papers 2026-07-04 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260704 10:01 Asia/Shanghai · 消化:20260704 21:00(反思同步重写 v2,覆盖 v1) 信源:Gradient Flow · (Substack,作者 Dylan Babbs,行业观察 + 一点预测) v1 状态(已废):1.5 KB / 5 …
Spark RSS 摘要 gradient-flow 2026-07-04 10:01
ByteByteGo · RSS 摘要
多区域架构:走向全球而不至于破产 — 当应用在地理上扩展时,从第二个区域开始服务以改善延迟和可用性是合理的。 OpenAI 如何为 9 亿用户提供低延迟语音 AI — 在本文中,我们将详细了解整个过程以及 OpenAI 工程团队所面临的挑战。 深入 Thinking Machines 的交互模型 — 在本文中,我们将了…
Jay RSS 摘要 bytebytego 2026-07-04 10:00
Simon Willison · RSS 摘要
开源 AI 差距图谱 — 开源 AI 差距图谱:Current AI 是"一个致力于打造 AI 公共选项的全球合作伙伴关系",于 2025 年 2 月在巴黎 AI Action Summit 上以非营利组织身份成立,并获得…… 引用 Josh W. Comeau — 我刚刚上线了第三门课程 Whimsical Anim…
Jay RSS 摘要 simon-willison 2026-07-04 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Jay RSS 摘要 raschka 2026-07-04 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是谁在掌控它。 AI 态势:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现编程能力对等、Agent 走进真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-07-04 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长周期任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习... LLM Benchmark 剖析 — 用于构建最有效 LLM …
flyP RSS 摘要 cameron-wolfe 2026-07-04 10:00
Lilian Weng (Lil'Log) · RSS 摘要
审慎看待扩展定律 — 扩展定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ 可预测地下降…… 我们为何思考 — 特别感谢 John Schulman 对本文提出的诸多宝贵反馈与直接修改。测试时计算(Graves et al. 2016, Ling, et al. 2017, …
Jay RSS 摘要 lilian-weng 2026-07-03 10:50