Jay
浏览全部笔记 · 1063 篇 · 工程实践 · CSDN · 开源动态
ByteByteGo · RSS 摘要
倒计时 3 天:AI Evals,十月开课 — Secure your spot in AI Evals in Practice. Enrollment closes in just 3 days! If you’ve been thinking about joining, now’s the…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外层 RSI 循环 — 你在哪些方面超出了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器释义学 — AI 正在撞上的那堵墙,就在我们身边吗? Import AI 472:DeepMind 的作弊数学 A…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其形式简洁:随着模型规模扩大,训练损失 L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中静默消耗加速器容量。我们最大的推荐工作负载处理数百亿条训练... AgentWebRec: 基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体,以及用户与推荐平台之间的中介,维护…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一种新的机器学习系统可以预测可能发生损坏的位置…… 介绍 Quine:为生物复杂性而设计的 AI 研究系统 — 生物学不是孤立运作的,其 AI 表示也不应该是孤立的。Quine 是一个早期研究项目,旨在创建生物学的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 的细粒度网络安全工具调用基准,提供免运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,被期望将分析师意图转化为工具调用。然而,现有评测侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理和全局约束满足的任务提供了相较自回归生成的优越替代方案…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁掌控它 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编码平价、Agent 落地真实市场,以及 OpenAI 获 …
Simon Willison · RSS 摘要
我们将需要在几乎所有方面设置默认的硬性预算上限 — 这是一项产品功能——未来数月乃至数年世界将对其需求大增:默认硬性预算上限。我所说的就是按用量付费的功能…… 九月赞助者专属通讯 — 我刚刚发出了九月刊赞助者专属月度通讯。如果你是赞助者(或现在立即开始赞助),可在此访问。本期:更多 Fable 课堂…… Rex 的恐龙…
ByteByteGo · RSS 摘要
EP228:SSH 的工作原理 — SSH 是一种在不安全网络环境中安全访问远程机器的方法。它从 SSH 客户端到远程机器(SSH server)建立 TCP 连接开始。 为什么状态是软件设计中最难处理的事情 — 本文将探讨为什么状态是软件开发中最难处理的问题,以及开发者可用来管理状态的多种策略。 DoorDash 如…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋到 Jev — RNN、CNN、Transformer 与校准的可视化指南,配有关于准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 块近期研究综述 Claude 如何为 AI 生成文本添加水印 …
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用大语言模型 深入探究像 ChatGPT 这样的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
预测电网面临的太空天气风险 — 极端太空天气事件会损坏地球上的电力系统,降低 GPS 精度并影响卫星运行。一种新的机器学习系统可以预测可能发生损坏的区域…… 介绍 Quine:面向生物复杂性的 AI 研究系统 — 生物学并非孤立运行,对其的 AI 表征也不应如此。Quine 是一项早期研究工作,旨在构建生物学的多模态世…
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱启动外部 RSI 循环 — 在哪些方面你超越了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅骨中的人脑;以及机器诠释学 — AI 所撞上的那面墙此刻就在我们身边吗? Import AI 472:DeepMind 的作弊数学 …
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement — Harness 工程助力自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类…… Scaling Laws, Carefully — 审慎看待 Scalin…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大型推荐训练集群中悄无声息地消耗加速器容量。我们的最大型推荐工作负载每轮迭代处理数百亿训练样本…… AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体以及用户与推荐平台之间的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 网络安全工具使用的细粒度基准,附带无运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,用于将分析师意图转化为工具调用。然而,现有评估侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理与全局约束满足的任务提供了一种引人注目的自回归生成替代方…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的重置、中国开源权重的代码能力对标、Agent 直面真实市场,以及 Op…
Simon Willison · RSS 摘要
引用 Matthew Green — […] 将这些部分组合起来,就构成了蠕虫的两半:一个劫持 Agent 的 payload,以及一个会将 payload 传递给下一个 Agent 的 Agent。各自分离的 Agent…… 《He Built This City》 — 我今天参观了纽约市立博物馆,观看了《He Bu…
Sebastian Raschka (Ahead of AI) · RSS 摘要
文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 模块的最新研究综述 Claude 如何给 AI 生成文本添加水印 …
ByteByteGo · RSS 摘要
为什么状态是软件设计中最难的部分 — 本文将探讨为什么状态是软件开发中最棘手的问题,以及开发者可以使用的多种管理策略。 DoorDash 如何为 AI Agent 构建工具箱 — 本文将介绍 DoorDash 工程团队如何构建该网关,以及他们所做的技术决策。 为什么 LLM 会"说谎"? — 本文将分析 LLM 出现幻…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究 ChatGPT 等 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时演讲] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 哪些方面已超出 LLM 的能力? Import AI 473:美国的超智能战略;小鼠颅内的人脑;以及机器诠释学 — AI 当前撞上的那面墙,是否就在这间房间里? Import AI 472:DeepMind 的作弊数学智能体…
Microsoft Research Blog · RSS 摘要
预测电网的空间天气风险 — 极端空间天气事件会损坏电力系统,影响 GPS 精度和卫星运行。一种新的机器学习系统可预测可能受损的位置…… 介绍 Quine:专为生物学复杂性设计的 AI 研究系统 — 生物学并非孤立运行,对其的 AI 表示也应如此。Quine 是一项早期研究工作,旨在构建生物学的多模态世界模型。通过连接……
Cool Papers · cs.CL (papers.cool) · RSS 摘要
EvoDuet:面向科学发现的网络搜索与任务求解双层协同进化 — 基于大语言模型(LLM)的进化搜索在需要模型缺失的外部知识时容易停滞。提供相关文档有所帮助,但仅简单添加…… AI token值多少?面向野生 AI 生成网络文本的缩放定律 — 网络文本构成了预训练数据的主体,且其中 AI 生成的内容日益增多。在应用 F…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯到 I. J. Good(1965),他将"超级智能机器"定义为一种能够在……方面超越人类的系统…… 谨慎地看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。该观察形式简洁:随着模型规模的扩大,训练…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
决策导向的推荐重排序:Jev 的实证研究 — 大语言模型(LLM)在推荐重排序中展现出潜力,但其使用在推荐质量与服务效率之间引入了显著的权衡。 KUAISHOU Explorer LLMRec 挑战赛 2026:推理生成式推荐 — 生成式推荐在工业界与学术界引起了广泛关注,旨在构建更智能的系统来打造下一代推荐… 当标签…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 的关系重置、中国开源权重的代码能力对等、Agent 走进真实市场,以及 Ope…
Simon Willison · RSS 摘要
引用 Matthew Green — 把这些部分拼在一起,你就得到了一条蠕虫的两半:一段劫持 agent 的 payload,以及一个会把 payload 传递给下一个 agent 的 agent。相互独立的 agent…… He Built This City — 我今天参观了纽约城市博物馆,观看了"He Built…
ByteByteGo · RSS 摘要
为什么 state 是软件设计中最难的部分 — 本文将探讨 state 为何是软件开发中最难的部分,以及开发者可以用来应对它的多种策略。 DoorDash 如何为 AI Agent 构建工具箱 — 本文将介绍 DoorDash 工程团队如何构建该网关及所做的技术决策。 LLM 为什么会"说谎"? — 本文将分析 LLM…