Jay
浏览全部笔记 · 615 篇 · 工程实践 · CSDN · 开源动态
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过相关意图生成改善电商搜索中的商品可发现性 — 传统搜索系统的优化目标是检索严格匹配查询的商品,通常优先考虑精确率而非召回率。在电商市场,尤其是杂货类…… KAMR:通过知识对齐多跳检索实现接地生成 — 基于图的检索增强生成越来越依赖多跳检索,其中回答查询需要组合多个相连的知识图谱三元组。然而…… 从未来学习:用于序…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究…
ByteByteGo · RSS 摘要
幂等性、投递语义与去重的详尽指南 — 当服务发送扣款请求却因超时未收到响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:Harness、API 与 Inference — 为理解前沿实验室为提升 AI 应用效率所采用的技术,我们采访了 OpenAI 内部负责开发并交付各类效率技术……的工程师。 为什么…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重启、中国开源权重模型实现代码能力追平、Agent 走入…
Simon Willison · RSS 摘要
用 GPT5.6 推进性价比边界 — 用 GPT5.6 推进性价比边界:OpenAI 今天大幅降价,GPT5.6 Terra 降价 20%,GPT5.6 Luna 降幅高达 80%。OpenAI 信用额度…… 在我们的网络安全评估中调查三起真实事件 — 在我们的网络安全评估中调查三起真实事件:又发生了!这似乎正在成为一…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Fireship (YouTube) · RSS 摘要
Anthropic 是不是刚刚扼杀了独立开发者? 历史上最有趣的"hack"…… Openweight AI 的参数量刚刚达到 2.8 万亿…… 这家估值 120 亿美元的初创公司终于发布了产品…… OpenAI 再因"剽窃"被告……
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训、AI 完成长达一周的编程任务,以及 OpenAI 的“意外 AI 黑客” — 警钟将持续敲响,直至文明觉醒 Import AI 465:开源与闭源差距、Kimi K3、Demis 的重大政策计划 — 奇点将被后人视为一段“过渡期” Import AI 464:Fable…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码时进行验证,同时保持速度和适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
传递接力棒:基于轨迹延迟的 OnPolicy 蒸馏 — OnPolicy 蒸馏(OPD)将 token 级监督锚定在学生模型自身轨迹上,但仍存在前缀失败问题:一旦学生模型在推理方向上出现早期误判,后续生成便难以挽回。 UniMem:面向无边界任务流的从情景记忆到参数记忆的互补记忆机制 — 记忆是 LLM Agent 累…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程:实现自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的经验性发现之一。其观察形式简洁:训练损失 L 随模型规模扩大而…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
RecoReward:推荐引导的多模态描述生成用于推荐 — 多模态大语言模型(MLLMs)可将多模态物品内容转换为结构化描述,作为推荐所用的语义特征。传统仅依赖内容的方法通常会受到内容质量限制,并受困于诸如物品冷启动和可扩展推理等长期挑战。我们提出 RecoReward,一个新颖的两阶段框架,引导多模态大语言模型首先生…
ByteByteGo · RSS 摘要
ChatGPT 如何优化其 Agent 循环:Harness、API 与推理 — 为理解前沿实验室采用了哪些技术来提升 AI 应用效率,我们与 OpenAI 工程师进行了交流,他们开发并上线了多项效率技术…… 为什么 DoorDash、Instacart 和 Uber Eats 以三种不同方式将 LLM 集成进搜索 —…
Simon Willison · RSS 摘要
引用 D. Richard Hipp — 很多年前,还没有 SQL。有些人专门编写软件来查询大型数据集,他们的职位叫 COBOL 程序员。后来 SQL 出现了…… AI 蠕虫渗透 Word — AI 蠕虫渗透 Word。Håkon Måløy 发现的全新 prompt injection 变体,可将对 Microsof…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开放权重模型的代码能力对等、Agent 走向真实市场,以及 O…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay 工程实践筛选 · RSS 增量补扫 · 2026-07-29 下午(v2 重写)
v2 重写说明:本文件原 v1 版本(已归档为 .v1.md.bak,本次覆盖为 v2)存在以下问题:(1) A1 DoorDash/Instacart/Uber Eats 文章与 10:55 RSS 轮次判断矛盾(v1 升 A 级,10:55 已 C 级丢弃);(2) A2 ByteByteGo 最佳实践混入"根据摘…
Jay 工程实践筛选 · 2026-07-29 RSS 深度轮(第三次·午间版)
本次保留 A级 3 条,B级 3 条,C级 4 条。本轮重点挖掘最新 RSS(20260729 上午批次)中的工程实践条目,对比昨日晚间版过滤结果,确认全新未覆盖条目。核心新增:Lilian Weng Harness Engineering(自我改进版)、MSR Memora 谐波记忆、uv 0.12.0 破坏性变更、…
Fireship (YouTube) · RSS 摘要
历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家 120 亿美元的初创公司终于发布了产品…… OpenAI 再次因盗用被起诉…… 历史上最具争议的重写刚刚发布……
Andrej Karpathy (YouTube) · RSS 摘要
如何使用 LLM 深入解析 ChatGPT 这类 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码的同时进行验证,并保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时…
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 的意外 AI 黑客 — 警钟将持续鸣响,直至文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的宏大政策计划 — 奇点在事后看来将是一个过渡期 Import AI 464:Fable 编…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… Scaling Laws 的审慎探讨 — Scaling laws 是深度学习中最重要的经验性发现之一。其形式简洁:随模型规模……训练损失 L …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
LaRec:释放基于 LLM 的潜在推理能力用于生成式推荐 — 大语言模型(LLMs)凭借强大的推理能力在推荐领域展现出巨大潜力。然而,现有方法主要依赖显式的 ChainofThought(Co… 一张图,多重收益:用于多模态推荐的单一高质量 itemitem 图 — 多模态推荐利用 item 的多模态特征结合协同信号…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
多轮长程规划物理:从预训练到后训练的单教师与多教师在策略智能体蒸馏 — 多轮长程规划对基础模型智能体至关重要,但如何从根本上提升其能力仍不清晰。现有模型在不可控且开…… DataOrchestra:学习编排预训练数据的逐样本策展 — 预训练数据处理对大型语言模型(LLM)的下游性能至关重要。然而,许多现有方法在整个………
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能一夜关停某个模型时,问题已不是 AI 是否安全,而是由谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型代码能力持平、Agent 走入真实市场,以及 OpenAI 拿下…
Simon Willison · RSS 摘要
使用 Claude 发现加密学弱点 — 使用 Claude 发现加密学弱点 本文最精彩的部分(仓库在此)介绍了 Anthropic 研究人员如何使用 Claude Mythos 在 b……中发现数学缺陷 引用 Akshat Bubna 的言论 — 我们获悉一位 Modal 客户发布了一个未经身份验证的端点,允许互联网上…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文…
ByteByteGo · RSS 摘要
Why DoorDash, Instacart, and Uber Eats 以三种不同方式将 LLM 集成进搜索 — 本文将逐一解析它们的不同方案,并尝试解释其选择背后的逻辑与模式。 NVIDIA 如何为 AI 时代构建开源模型 — NVIDIA 应用深度学习研究副总裁 Bryan Catanzaro 分享了其团队如…
Fireship (YouTube) · RSS 摘要
历史上最有趣的"hack"… 开源权重 AI 刚达到 2.8 万亿参数… 这家估值 120 亿美元的创业公司终于发布了产品… OpenAI 又因窃取被起诉… 史上最具争议的重写刚刚发布…