Jay
浏览全部笔记 · 615 篇 · 工程实践 · CSDN · 开源动态
Cool Papers · cs.CL (papers.cool) · RSS 摘要
VisionDefault, PriorOverride:视觉语言模型中感知知识冲突的因果机制 — 当视觉证据与记忆中的世界知识相冲突时,视觉语言模型必须进行调和。其解决冲突的方式决定了多模态系统的可靠性…… LLM 推理轨迹中的认知片段可实现可解释的人类题目难度预测 — 预测人类题目难度是教育评估的核心,可靠的估计有…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Fast and Feasible:基于排列的约束重排序以实现收益最大化 — 搜索与推荐系统已能产出高度相关的搜索结果。在电商场景中,这类系统发展的自然下一步是对这些结果进行重排序以…… 通过语义块分组对基于嵌入的排序进行列表式解释 — 稠密嵌入排序器通过上下文句子级和段落级表示对文档打分。然而,许多列表式解释方法仍将…
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及为人本时代谱写的挽歌式随笔 — 我们的过渡期由哪些时代所夹持? Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 — 对奇点技术的信仰有多接近宗教? Import AI 461:"对齐研究未步入正轨";FrontierC…
ByteByteGo · RSS 摘要
AI Agent 如何管理记忆并避免遗忘 — 本文将试图理解该架构是如何构建的——从迫使它产生的约束条件,到随之而来的权衡取舍。 EP220:RAG vs Graph RAG vs Agentic RAG — RAG 将 LLM 连接到你的数据,实现方式主要有三种。 服务架构中需要避免的顶级反模式 — 本文将介绍服务架…
Simon Willison · RSS 摘要
引用 Jon Udell — Human Agent in the loop 我不喜欢"human in the loop"这个说法,因为它把权威让渡给了机器。让我们翻转叙事。这是我们的 loop,我们一如既往地工作…… Hack Your Summer — Hack Your Summer 今天早上我从 DJ Pat…
ByteByteGo · RSS 摘要
EP220:RAG vs Graph RAG vs Agentic RAG — RAG 将 LLM 连接到数据,且存在三种不同的实现方式。 服务架构中需避免的顶级反模式 — 本文将探讨服务架构中一些最常见的反模式,分析其成因与规避方法。 大型语言模型 vs 小型语言模型 — 本文将从模型设计的三个层次来探讨这些约束,分…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
NOVA:面向工业推荐系统架构演化的验证感知 Agent 框架 — 工业广告推荐模型通过架构演化持续迭代升级。RankMixer、TokenMixerLarge 和 MixFormer 等升级表明,更优的 st… TRUST:面向时序会话推荐的物品校准区间证据 — 时序信号已被广泛用于会话推荐以推断用户兴趣。现有时序会…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
使用多语言联合实体关系抽取流水线绘制欧洲政治精英网络 — 政治精英是组织成攫取公共资源的寻租联盟,还是形成维持治理的公民网络,是比较政治学中的一个核心问题 通过自主经验探索与事后经验利用赋能 GUI Agent 以进行任务规划 — 多模态 Web Agent 可以协助人类处理重复性 GUI 任务,其中有效的任务规划对于…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(一月至五月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharing、m…
Sebastian Raschka (Ahead of AI) · RSS 摘要
2026 年 LLM 研究论文汇总(1 月至 5 月) — 精选本年度值得关注的 LLM 研究论文综述 LLM 架构最新进展:KV Sharing、mHC 与 Compressed Attention — 从 Gemma 4 到 DeepSeek V4:新一代开源权重 LLM 如何降低长上下文成本 我理解 LLM 架构…
Import AI (Jack Clark) · RSS 摘要
Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 — 对奇点的信仰有多"宗教化"? Import AI 461:"对齐并未步入正轨";FrontierCode;以及合成研究实习生 — 你的 Agent 现在在哪里? Import AI 460:奖励黑客化的社会、Anthropic 的 RSI…
ByteByteGo · RSS 摘要
服务架构中最应避免的核心反模式 — 本文将梳理服务架构中几类最关键的反模式,分析其成因与规避方法。 大语言模型 vs 小语言模型 — 本文将从模型设计的三个层面剖析这些约束,权衡各路线的取舍,并考察其生产系统…… 一位前 Meta L8 工程师的 Agentic 工程实践配置 — 如果你也在寻求让 Agent 协作更高…
Lilian Weng (Lil'Log) · RSS 摘要
细致解读 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的扩大,训练损失 $L$ 会以可预测的方式下降…… 我们的思考 — 特别感谢 John Schulman 对本文提供的宝贵反馈和直接修改。Test time compute(Graves e…
Simon Willison · RSS 摘要
引用 Dean W. Ball — 这是一种糟糕的局面。尤其考虑到一些行业动态:前沿模型训练成本极高,而其中相当大一部分成本是通过…… 引用 Timothy B. Lee — 这就好比说做管理者没有学习曲线,因为员工会完全照你说的去做。—— Timothy B. Lee,评论 LLM…… 2,000 人尝试入侵我的 A…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型在编程能力上的对等、Agent 走入真实市场,以及 O…