Jay
浏览全部笔记 · 615 篇 · 工程实践 · CSDN · 开源动态
Cool Papers · cs.IR (papers.cool) · RSS 摘要
并非所有视觉 token 都同等重要?面向视觉语言检索的物体证据保持 token 合并 — 多向量视觉语言检索通过最大相似度晚交互保留细粒度视觉证据,但图像侧密集 token 使存储与打分开销较大。 无监督学术合作推荐的评价与可解释性 — 本文在学术场景下基于发表文本研究无监督、基于内容的合作推荐,并比较了三类方法:基…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损…
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;万卡中国 GPU 集群;以及一篇致人类时代的悼文 — 我们的过渡期由哪些时代前后衔接? Import AI 462:超级说服;自我维持的 AI;通向 A…
Simon Willison · RSS 摘要
sqliteutils 4.0,现已支持数据库 schema 迁移 — 今早我发布了 sqliteutils 4.0,这是该项目的第 124 次发布,也是自 2020 年 11 月 3.0 以来的首次重大版本升级。除了一些小但重要的改动之外…… sqlitemigrate 0.2 — 发布:sqlitemigrate …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 遇见真实市场,以…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
SPEARBench:面向流式语音到语音语言模型自然度评估的基准 — 流式语音到语音语言模型旨在直接用合成语音回答口语查询。然而,标准语音和文本基准无法捕捉这些系统是否在流式场景下产生自然听感的语音。我们提出 SPEARBench,一个用于评估流式语音到语音语言模型自然度的基准。 REDDIT:通过基于回放的分发编辑校…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
ByteByteGo · RSS 摘要
ChatGPT vs Gemini vs Claude:它们有何不同 — 本文将详细探讨构建这些模型的团队所遇到的各种架构分歧以及他们所做的决策。 招生最后机会:成为 AI 工程师 第 7 期 — 成为 AI 工程师第 7 期课程将于不到一周后开课。这是一门直播制的同期课程,由畅销书作者 Ali Aminian 合作打…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心托管着数千个地球科学数据集和工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。即便…,找到合适的数据集也很困难。 面向候选生成的矩阵分解 MDP 规划 — 在推荐服务中,…
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及致人类时代的挽歌式文章 — 哪些时代构成了我们过渡期的首尾? Import AI 462:超级说服;自我维持的 AI;通向 ASI 的…
Lilian Weng (Lil'Log) · RSS 摘要
Scaling Laws, 审慎以待 — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式很简单:随着模型规模扩大,训练损失 $L$ 会可预测地下降…… 为什么我们会思考 — 特别感谢 John Schulman 对本文提供了大量宝贵的反馈和直接修改。测试时计算(Graves et al. 201…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:评估 LLM 遗忘定位精度的测试平台 — LLM 会记忆敏感训练数据,包括个人身份信息(PII),亟需可靠的事后删除方法。遗忘技术应运而生…… 推理 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成严峻挑战,解读复杂剧情通常依赖说话人识别任务…… 基于强化学习的视觉语言模型视觉锚定自…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开源权重模型的代码能力追平、Agent 走入真实市场,以及 Op…
ByteByteGo · RSS 摘要
报名最后机会:成为 AI 工程师——第 7 期 — 成为 AI 工程师第 7 期将于不到一周后开课。这是一门由畅销书作者 Ali Aminian 合作打造的直播同期课程…… 人机验证:如何验证一个人真实且唯一 — 本文采访了 World 背后的团队,包括 Tools for Humanity 的 Tiago Sada …
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 框架中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing、mHC 与 Compres…
Simon Willison · RSS 摘要
tencent/Hy3 — 腾讯发布的新 Apache 2.0 许可模型 Hy3:295B 参数的 MixtureofExperts (MoE) 模型,激活参数 21B,MTP 层参数 3.8B sqliteutils 4.0rc3 — 发布:sqliteutils 4.0rc3。原计划本周末发布 sqliteutil…
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;一个由 1 万张 GPU 组成的中国集群;以及一篇悼念人类时代的挽歌式文章 — 哪些时代构成了我们过渡期的首尾两端? Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 — 对奇点的信仰有多接近宗教? Import AI 461:"alignmen…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入对地观测数据发现 — NASA 及其数据中心托管着数千个地球科学数据集与工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。找到合适的数据集与工具极为困难…… 基于矩阵分解 MDP 的候选生成规划 — 对于推荐服务,…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:用于评估 LLM 遗忘(Unlearning)定位精度的测试平台 — LLMs 会记忆包括个人身份信息(PII)在内的敏感训练数据,因此迫切需要可靠的事后删除方法。遗忘(Unlearning)方法应运而生…… 推理型 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成严峻挑战,解读复杂…
Lilian Weng (Lil'Log) · RSS 摘要
谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式很简洁:训练损失 L 随模型规模…可预测地下降。 我们为何如此思考 — 特别感谢 John Schulman 提出的诸多宝贵反馈与直接修改。测试时计算(Graves et al. 2016, Ling, et al…
Simon Willison · RSS 摘要
sqliteutils 4.0rc2,主要由 Claude Fable 编写(花费约 149.25 美元) — 几周前我写过关于 sqliteutils 4.0rc1 发布的文章。由于 Max 订阅只能再使用 Claude Fable 几天,我决定看看它能否帮… sqliteutils 4.0rc2 — 发布:sqli…
ByteByteGo · RSS 摘要
人类证明:如何验证一个人是真实且唯一的 — 为本文我们采访了 World 团队,包括 Tools for Humanity 的 Tiago Sada 和 Lily Gordon,了解他们如何尝试解决该问题。 多区域架构:走向全球而不至于破产 — 当应用在地理上扩展时,从第二个区域开始提供服务以改善延迟和可用性是合理的。…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、Microsoft 与 OpenAI 关系重置、中国开源权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 工具链中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharing、mHC 和 Co…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:一个用于评估 LLM Unlearning 定位精度的测试平台 — LLM 会记忆包括个人身份信息(PII)在内的敏感训练数据,对可靠的事后删除方法提出了迫切需求。Unlearning 应运而生…… 推理 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面的视频理解构成严峻挑战,解读复杂剧情通常依…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心拥有数千个地球科学数据集,以及 Worldview、Giovanni、Science Discovery Engine 和 Harmony 等工具。即便是经验丰富的研究人员,找到合适的数据也并非易事…… 基于矩阵分解 MDP 的候选生成规…
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;一万张中国 GPU 集群;以及一篇属于人类时代的哀歌 — 哪些时代标志着我们这个过渡期的开端与终结? Import AI 462:超强说服力;自我维持的 AI;通往 ASI 的路径 — 关于奇点的信仰有多像宗教信仰? Import AI 461:"Alignment 并没有…
Lilian Weng (Lil'Log) · RSS 摘要
谨慎审视 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的提升,训练损失 $L$ 可预测地下降…… 我们如何思考 — 特别感谢 John Schulman 对本文提供了大量极具价值的反馈和直接修改。测试时计算(Graves et al. 2016…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 环境中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1—5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing、mHC 与 Co…
ByteByteGo · RSS 摘要
Proof of Human:如何验证一个人是真实且唯一的 — 为本文我们与 World 团队进行了交流,包括 Tools for Humanity 的 Tiago Sada 和 Lily Gordon,了解他们如何尝试解决这一问题。 多区域架构:走向全球而不致破产 — 当一个应用在地理上不断扩展时,从第二个区域开始提…