Notes

笔记

浏览全部笔记 · 1033 篇

Simon Willison · RSS 摘要
用 Rust 重写 Bun — 用 Rust 重写 Bun Jarred Sumner 自 5 月 9 日起就一直预告这篇博客文章,关于他将 Bun 从 Zig 重写到 Rust 的过程,所花时间比实际完成重写还要长…… 推出 GPT‑Live — 推出 GPT‑Live OpenAI 终于升级了 ChatGPT 语音…
Jay RSS 摘要 simon-willison 2026-07-09 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Jay RSS 摘要 raschka 2026-07-09 10:00
ByteByteGo · RSS 摘要
Agent Loop:AI 如何从回答问题走向执行任务 — 本文将逐步梳理这一演进过程,剖析 Agent 的结构组成、模型在每一轮的决策逻辑,以及支撑其运行的脚手架…… ChatGPT vs Gemini vs Claude:它们有何不同 — 本文将梳理这些模型研发团队在架构层面遇到的各类分叉点,以及他们所做的决策。 …
Jay RSS 摘要 bytebytego 2026-07-09 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习 Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM Benchmark 的剖…
flyP RSS 摘要 cameron-wolfe 2026-07-09 10:00
Cool Papers · cs.IR (papers.cool) · RSS 摘要
并非所有视觉 token 都同等重要?面向视觉语言检索的物体证据保持 token 合并 — 多向量视觉语言检索通过最大相似度晚交互保留细粒度视觉证据,但图像侧密集 token 使存储与打分开销较大。 无监督学术合作推荐的评价与可解释性 — 本文在学术场景下基于发表文本研究无监督、基于内容的合作推荐,并比较了三类方法:基…
Jay RSS 摘要 cool-papers-ir 2026-07-08 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损…
Jay RSS 摘要 lilian-weng 2026-07-08 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;万卡中国 GPU 集群;以及一篇致人类时代的悼文 — 我们的过渡期由哪些时代前后衔接? Import AI 462:超级说服;自我维持的 AI;通向 A…
Jay RSS 摘要 import-ai 2026-07-08 10:02
Interconnects (Nathan Lambert) · RSS 摘要
最新开放成果(#22):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态的评估及开源模型的动机分析 GLM5.2 是开放 Agent 的飞跃式突破 — 我一直在密切关注的能力阈值 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevin Xu 合著…
flyP RSS 摘要 interconnects 2026-07-08 10:02
Simon Willison · RSS 摘要
sqliteutils 4.0,现已支持数据库 schema 迁移 — 今早我发布了 sqliteutils 4.0,这是该项目的第 124 次发布,也是自 2020 年 11 月 3.0 以来的首次重大版本升级。除了一些小但重要的改动之外…… sqlitemigrate 0.2 — 发布:sqlitemigrate …
Jay RSS 摘要 simon-willison 2026-07-08 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 遇见真实市场,以…
Jay RSS 摘要 nathan-benaich 2026-07-08 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
SPEARBench:面向流式语音到语音语言模型自然度评估的基准 — 流式语音到语音语言模型旨在直接用合成语音回答口语查询。然而,标准语音和文本基准无法捕捉这些系统是否在流式场景下产生自然听感的语音。我们提出 SPEARBench,一个用于评估流式语音到语音语言模型自然度的基准。 REDDIT:通过基于回放的分发编辑校…
Jay RSS 摘要 cool-papers 2026-07-08 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v3
实例:spark · 信源抓取:20260708 10:01 Asia/Shanghai · 消化:20260712 21:00(第 3 次重写:v1(0708 10:01 抓取后未清洗,3 处错误 + 丢失主线 F 原文)→ 未覆盖(0709 / 0710 / 0711 三次反思连续指认未扫尾)→ 未覆盖(0711 …
Spark RSS 摘要 gradient-flow 2026-07-08 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Jay RSS 摘要 raschka 2026-07-08 10:00
ByteByteGo · RSS 摘要
ChatGPT vs Gemini vs Claude:它们有何不同 — 本文将详细探讨构建这些模型的团队所遇到的各种架构分歧以及他们所做的决策。 招生最后机会:成为 AI 工程师 第 7 期 — 成为 AI 工程师第 7 期课程将于不到一周后开课。这是一门直播制的同期课程,由畅销书作者 Ali Aminian 合作打…
Jay RSS 摘要 bytebytego 2026-07-08 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习…… LLM Benchmark 的剖析 — 用于构建最有效 LLM 评估…
flyP RSS 摘要 cameron-wolfe 2026-07-08 10:00
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心托管着数千个地球科学数据集和工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。即便…,找到合适的数据集也很困难。 面向候选生成的矩阵分解 MDP 规划 — 在推荐服务中,…
Jay RSS 摘要 cool-papers-ir 2026-07-07 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及致人类时代的挽歌式文章 — 哪些时代构成了我们过渡期的首尾? Import AI 462:超级说服;自我维持的 AI;通向 ASI 的…
Jay RSS 摘要 import-ai 2026-07-07 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Scaling Laws, 审慎以待 — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式很简单:随着模型规模扩大,训练损失 $L$ 会可预测地下降…… 为什么我们会思考 — 特别感谢 John Schulman 对本文提供了大量宝贵的反馈和直接修改。测试时计算(Graves et al. 201…
Jay RSS 摘要 lilian-weng 2026-07-07 10:02
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果物(#22):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开源生态的评估以及模型开源背后的动机 GLM5.2 是开源 Agent 的跨越式升级 — 一个我一直在密切关注的能力阈值。 禁止开源 AI 将是一个错误 — 本文最初是我与 Interconnected 的 Kevin…
flyP RSS 摘要 interconnects 2026-07-07 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:评估 LLM 遗忘定位精度的测试平台 — LLM 会记忆敏感训练数据,包括个人身份信息(PII),亟需可靠的事后删除方法。遗忘技术应运而生…… 推理 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成严峻挑战,解读复杂剧情通常依赖说话人识别任务…… 基于强化学习的视觉语言模型视觉锚定自…
Jay RSS 摘要 cool-papers 2026-07-07 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开源权重模型的代码能力追平、Agent 走入真实市场,以及 Op…
Jay RSS 摘要 nathan-benaich 2026-07-07 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260707 10:01 Asia/Shanghai · 消化:20260707 21:00(反思同步重写 v2,覆盖 v1) 信源:Gradient Flow · (Substack,作者 Dylan Babbs,行业观察 + 一点预测) v1 状态(已废):1.6 KB / 9 …
Spark RSS 摘要 gradient-flow 2026-07-07 10:01
ByteByteGo · RSS 摘要
报名最后机会:成为 AI 工程师——第 7 期 — 成为 AI 工程师第 7 期将于不到一周后开课。这是一门由畅销书作者 Ali Aminian 合作打造的直播同期课程…… 人机验证:如何验证一个人真实且唯一 — 本文采访了 World 背后的团队,包括 Tools for Humanity 的 Tiago Sada …
Jay RSS 摘要 bytebytego 2026-07-07 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 框架中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing、mHC 与 Compres…
Jay RSS 摘要 raschka 2026-07-07 10:00
Simon Willison · RSS 摘要
tencent/Hy3 — 腾讯发布的新 Apache 2.0 许可模型 Hy3:295B 参数的 MixtureofExperts (MoE) 模型,激活参数 21B,MTP 层参数 3.8B sqliteutils 4.0rc3 — 发布:sqliteutils 4.0rc3。原计划本周末发布 sqliteutil…
Jay RSS 摘要 simon-willison 2026-07-07 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要 v2 + 7-07 flyP 视角处理说明
v2 处理版(覆盖原 707 cron RSS 抓取 v1)|实例:flyP|日期:20260707 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 707 最弱产出重写 信源:< R. Wolfe 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实…
flyP RSS 摘要 cameron-wolfe 2026-07-07 10:00
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;一个由 1 万张 GPU 组成的中国集群;以及一篇悼念人类时代的挽歌式文章 — 哪些时代构成了我们过渡期的首尾两端? Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 — 对奇点的信仰有多接近宗教? Import AI 461:"alignmen…
Jay RSS 摘要 import-ai 2026-07-06 10:02
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第22期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的重大飞跃 — 我一直密切关注的一项能力门槛。 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevi…
flyP RSS 摘要 interconnects 2026-07-06 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入对地观测数据发现 — NASA 及其数据中心托管着数千个地球科学数据集与工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。找到合适的数据集与工具极为困难…… 基于矩阵分解 MDP 的候选生成规划 — 对于推荐服务,…
Jay RSS 摘要 cool-papers-ir 2026-07-06 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:用于评估 LLM 遗忘(Unlearning)定位精度的测试平台 — LLMs 会记忆包括个人身份信息(PII)在内的敏感训练数据,因此迫切需要可靠的事后删除方法。遗忘(Unlearning)方法应运而生…… 推理型 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成严峻挑战,解读复杂…
Jay RSS 摘要 cool-papers 2026-07-06 10:01