Jay
浏览全部笔记 · 615 篇 · 工程实践 · CSDN · 开源动态
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;中国万卡 GPU 集群;以及一篇悼念人类时代的散文 — 哪些时代构成了我们的"间歇期"? Import AI 462:超级说服;自维持 AI;通往 ASI 的路…
Microsoft Research Blog · RSS 摘要
SymCrypt 中的 Rust 密码学验证:从标准到代码 — 密码学代码为现代计算系统提供关键防护。了解一种新方法如何在开发人员编写代码时验证代码,同时保持速度与适应性 Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时间分…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类…… 谨慎地看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模…… 我们为何要…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开放权重模型的代码能力持平、Agent 走入真实市…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Hindcast:重放预测市场以评估 LLM 预测者 — 通过回测评估预测者,即重放已解决的问题并对系统在结果已知前应给出的概率进行打分。针对 LLM,存在两个…… 老狗能否学会新把戏?让 LLM 超越句子级翻译 — 从 CAT 工具到 MT,自动翻译系统几乎都将翻译视为逐句操作。本文探讨能否将 LLM 突破这一范式……
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化生成式引擎中的可见性:生成式引擎优化的关键综述(20232026) — 生成式引擎优化(GEO)旨在提升内容在生成式引擎生成答案中的存在感、被引用的可能性或其影响力。自奠基性的 G… 基于拍卖的向量搜索聚类 — 大规模近似最近邻搜索通常依赖分区索引:数据库向量被划分为多个聚类,针对每个查询,一个探测函数 s… 基于…
ByteByteGo · RSS 摘要
多租户指南:优势与挑战 — 本文将从基础开始介绍多租户架构,并分析其各项优势与挑战。 大规模 AI 客户支持:旅游业的十亿美元押注 — 本文将沿支持流程从第一性原理出发,深入分析各类解决方案,展示为何部分长尾案例难以被自动化…… LLM 如何学会有用(RLHF vs DPO) — 本文将探讨这种学习是如何实际发生的,先…
Simon Willison · RSS 摘要
Firefox in WebAssembly — Firefox in WebAssembly 这太酷了:Puter 将 Firefox 编译为 WebAssembly,使整个浏览器运行在另一个浏览器中。这是我的博客,运行在 Firefox 中,运行在…… Kimi K3,以及我们仍能从 pelican benchma…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Shar…
Fireship (YouTube) · RSS 摘要
历史上最具争议的重写刚刚发布… OpenAI 强势回归… GPT 5.6 Sol 抢先看 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有个新支线任务… 死亡
Andrej Karpathy (YouTube) · RSS 摘要
我是如何使用 LLM 的 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及写给人本时代的悼亡式随笔 — 哪些时代框定了我们的过渡期? Import AI 462:超级说服;自我维持的 AI;通往 AS…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学实现:从标准到代码 — 密码学代码为现代计算系统提供关键的安全保障。了解一种新方法如何在开发者编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:扩展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
ViHoRec:一个质量可控的越南酒店推荐数据集与冷启动基准 — 越南语推荐系统研究受限于缺乏公开且文档完善的酒店交互资源。构建此类资源面临三方面的挑战…… RecRec:面向序列推荐的潜在兴趣递归推理 — 序列推荐系统依赖单次前向传播来编码用户交互历史并预测下一项。通过潜在推理增加推理时计算量…… Learning …
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模……的扩大,训…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
PalmClaw:面向手机的原生端侧 Agent 框架 — LLM Agent 已不再局限于生成回复,而是通过调用工具、观察结果并迭代决定下一步操作来执行多步任务…… 鲁棒性的假象:在任务无关上下文下,整体准确率掩盖了预测翻转 — 随着 LLM 能力日益增强,它们被越来越多地部署在上下文丰富的场景中,任务输入常伴随冗长…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的重置、中国开放权重模型的编程能力对等、Agent 接入真实…
Simon Willison · RSS 摘要
Mermaid 转 Unicode 框图(grokmermaid) — 工具:Mermaid 转 Unicode 框图(grokmermaid)。在探索刚开源的 Grok CLI coding agent 代码库时,我在 xaigrokmarkdown/src/mermaid.rs 中发现了一个“se…… xaiorg…
ByteByteGo · RSS 摘要
AI 客户支持规模化:旅游业的数十亿美元豪赌 — 本文将从第一性原理出发,沿支持流程逐一剖析各类方案,揭示为何总有一部分长尾用例始终难以被自动化所覆盖…… LLM 如何学会"有用"(RLHF 与 DPO) — 本文将剖析这一学习的真实过程:从单纯的指令遵循为何不足谈起,再依次讲解当前两种主流的训练方法…… 微软如何在企…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地编码 Agent — 在本地编码 Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1—5 月) — 精选汇总本年度值得关注的 LLM 研究论文 LLM 架构最新进展:KV Sharing、mHC 与 Compressed At…
Fireship (YouTube) · RSS 摘要
OpenAI 回归了…GPT 5.6 Sol 首发速览 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有了新的支线任务…死亡 地球上最受信赖的代码正在用 Rust 重写
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? 自我改进的机器人;万卡中国 GPU 集群;以及一篇写给人类时代的悼文 — 哪些时代框定了我们的过渡期? 超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰有多像宗教? "对齐并未走上正轨";FrontierCode;以及合…
Microsoft Research Blog · RSS 摘要
从标准到代码:在 SymCrypt 中验证 Rust 密码学实现 — 密码学代码为现代计算系统提供关键安全防护。了解一种新方法如何在保持速度和灵活性的同时,帮助开发者在编写代码时进行验证…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
仅分数蒸馏用于紧凑型密集检索 — 大型 embedding 模型能提升检索质量,但在线部署大编码器成本高昂。本文研究紧凑型检索器能否仅从打分中学习教师模型的排序行为…… FAIR GraphRAG:一种用于语义数据分析的检索增强生成方法 — 检索增强生成(RAG)缓解了 LLM 在回答领域特定问题时的局限。基于图的 R…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LLM 中的元认知:基础、进展与机遇 — 元认知是智力的基础组成部分,对有效学习、问题解决、决策、沟通等至关重要。近年来,它已成为…… 一个已验证教学反馈分类协议的耐久性与跨语言迁移基准 — 机构收集的开放式教学评估反馈远多于其实际阅读量。先前的研究提出了一种已验证的协议,用于按主题类别对此类评论进行分类…… Adva…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间关停某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开源权重的代码能力对等、Agent 接入真实市场,以及 Open…
Simon Willison · RSS 摘要
引用 GitHub Changelog — Dependabot 现在会在新版本在其 registry 上可用至少三天后,才打开版本更新 pull request。该冷却期已成为默认设置…… simonw/pedalican — simonw/pedalican 显然我之前没注意到这些在五月首次发布的消息,但今天我在 …
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 清单(1 月至 5 月) — 精选本年度值得关注的 LLM 研究论文汇总 LLM 架构最新进展:KV Sharing、mHC 与 C…