Jay
浏览全部笔记 · 615 篇 · 工程实践 · CSDN · 开源动态
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力追平、Agent 走向真实市场,以及 OpenA…
Fireship (YouTube) · RSS 摘要
史上最有趣的"hack"… 开源权重 AI 参数达到 2.8 万亿… 这家估值 120 亿美元的初创公司终于交付了产品… OpenAI 再次因窃取被起诉… 史上最具争议的重写版本已发布…
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时即进行验证,同时保持速度与适应性…… Aurora 1.5:扩展用于天气和地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型中新增 22 个变量、逐小…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源与闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点将在事后被视为一段过渡期 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是一个新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;以及一篇…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够超越人类…… 谨慎看待 Scaling Laws — Scaling Laws 是深度学习中最关键的实证发现之一。其观察形式简单:训练损失 $L$ 随着模型规模…… 为什么我们思…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
缺乏理性基础时,惊奇度理论是同义反复的 — 惊奇度理论认为语境中语言单元的人类处理难度是其于某语言模型下惊奇度的仿射函数。本文论证该主张…… MedGame:由大语言模型驱动的故事化游戏化医学教育 — 大语言模型(LLMs)在医学教育中具有潜力,但现有系统大多聚焦于问答或单轮反馈等局部交互,较少…… DONDO:面向非…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
用于推荐的扩散语言模型 — 由 LLM 赋能的推荐系统已成为生成式推荐的一种有前景的范式,借助其强大的语义推理与生成能力…… SHIFT:自重建挖掘隐式细粒度思维以用于检索 — 基于 LLM 的检索器已成为现代信息检索系统的核心组件。"改写再检索"范式在检索前引入显式推理…… 弥合结构鸿沟:将自回归生成适配于推荐 — …
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究…
ByteByteGo · RSS 摘要
时钟、因果关系与分布式系统排序入门指南 — 为什么像读取时间这么简单的事会成为分布式系统中的难题? 构建可在生产环境中稳定运行的 AI Agent 最佳实践 — 本文尝试将众多共识提炼为一组精简的实践,并解释每项实践背后的 reasoning,而非要求大家死记硬背大量…… 深入 Roblox 的 World Model…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,核心问题已不再是 AI 是否安全,而是由谁来掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络攻击阈值、Microsoft 与 OpenAI 的关系重置、中国开源模型的代码能力追平、自主 Agent 走进真实市…
Simon Willison · RSS 摘要
引用 Boris Cherny — 比这些评测分数更让我兴奋的,是另一件事:Opus 5 是我们迄今为止最不容易被 prompt injection 的模型。这一点在 system card 中有些被埋没了,但 acro… 正式发布 Claude Opus 5 — 正式发布 Claude Opus 5 我今天大部分时间…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Fireship (YouTube) · RSS 摘要
历史上最有趣的"hack" 开放权重 AI 刚突破 2.8 万亿参数 这家估值 120 亿美元的初创公司终于发布了产品 OpenAI 再因剽窃被起诉 历史上争议最大的重写版刚刚发布
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简单:训练损失 $L$ 随模型规模…… 我们为何…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策规划 — 技术奇点在事后回顾时将只是一段过渡期 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学实现:从标准到代码 — 密码学代码为现代计算系统提供关键的安全防护。了解一种新方法如何在开发人员编写代码时进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LKValues:将 LLM 与斯里兰卡社会价值观对齐 — LLM 的价值对齐已被证明存在偏向西方规范的文化偏见,导致在多语言社会中本地价值被错误处理…… Notes to Self:LLM 能否从经验抽象中受益? — 人类会将经验提炼为可复用的抽象(如策略与警示提醒),并逐步应用以更高效地解决问题。本文研究大语言模型…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
UniRank:面向统一序列建模与特征交互的排序模型基准测试 — 排序是在线广告和推荐系统的核心环节。现代排序模型日益将序列建模与特征交互加以统一,但许多进展依赖于…… 利用层次化受控词表理解历史照片集合中的 CLIP 检索失败 — GLAM 机构(美术馆、图书馆、档案馆和博物馆)使用受控词表(如艺术与建筑叙词表 AA…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以及 O…
ByteByteGo · RSS 摘要
分布式系统中时钟、因果性与排序的入门指南 — 为什么在分布式系统中,读这么简单的事会变成一个难题? 构建生产环境可用 AI Agent 的最佳实践 — 本文尝试将集体思考提炼为一组精简的实践,并解释每条实践背后的推理,而不是要求读者记忆大量…… 深入了解 Roblox 对世界模型的下注 — 我们与 Roblox 工程高…
Simon Willison · RSS 摘要
首个已知的失控 AI agent——还是一场非常糟糕的营销炒作? — 首个已知的失控 AI agent——还是一场非常糟糕的营销炒作?Martin Alderson 对 OpenAI 对 Hugging Face 意外网络攻击的评论包含了一些细节…… 引用 Seth Larson — Python Package In…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(一月至五月) — 今年值得关注的 LLM 研究论文精选…
Fireship (YouTube) · RSS 摘要
开放权重 AI 参数规模突破 2.8 万亿 这家 120 亿美元估值的初创公司终于交付了产品 OpenAI 再陷数据盗用诉讼 史上最具争议的重写项目正式发布 OpenAI 卷土重来:GPT 5.6 Sol 首发速览
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 1 小时讲座:LLM 入门
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策规划 — 奇点将被视为一个过渡期,唯有事后才能看清 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键的安全防护。了解一种新方法如何在开发人员编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量…
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
少复制,多落地:基于证据感知强化学习克服长上下文推理中的重复复制问题 — 生成逐步推理轨迹的大语言模型在复杂任务上已取得强劲性能,将其扩展到长上下文场景已成为一个…… 用于语言模型推理的选择性状态空间适配与检索 — 低秩适配引入一个静态学习更新,对每个输入完全一致地应用。该更新提供任务级适配,但不显式表示 token …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
PAGERAG:面向长文档问答的证据驱动自适应图检索 — GraphRAG 通过引入传统检索之外的结构化表示来提升长文档问答效果。然而,自动构建的图本质上…… 谱双聚类驱动的可扩展性,用于推荐系统的事后可解释性 — 推荐系统的可解释性对于保证透明度、责任性和信任至关重要,但现有事后方法常面临严重的可扩展性挑战…… 答案…