Jay
浏览全部笔记 · 1052 篇 · 工程实践 · CSDN · 开源动态
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体规模化;Google DeepMind 为生物学加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图心智空间;TPU 上太空;Zhipu 开启外部 RSI 循环 — 在哪些场景你会超越 LLM 的能力? Import AI 473:美国的超级智…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地面电力系统、降低 GPS 精度并影响卫星运行。一种新的机器学习系统可以预测可能受损的位置…… 介绍 Quine:为应对生物学复杂性而设计的 AI 研究系统 — 生物学并非孤立运作,其 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的多模态世…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的驾驭工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待缩放定律 — 缩放定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ 可预测地下降…… 我们为何思…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
下棋并解释走法的语言模型 — 现代国际象棋引擎是沉默的专家:它们以超人水平对弈,却不为棋步提供解释。另一方面,语言模型(LMs)能够生成看似合理的…… FALCON:一个用于 NL2SQL 配对合成数据生成的、与模型和数据集无关的框架 — 关系数据库是部署最广泛的结构化知识形式之一,通过自然语言访问它们需要将语言锚定到…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
模型生物文献检索基准测试:Dictyostelium 案例研究 — 生物文献检索系统通常基于广泛的生物医学语料库与通用搜索任务进行开发与评估。然而,许多精心整理的知识库… 即使向量检索在几何上很简单,学习查询编码器也可能很困难 — 高效向量检索需要同时具备两个条件:支持通过向量相似度检索相关文档的语料库几何结构,以及能…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重的编程平价、Agent 走向真实市场,以及 OpenAI 获…
Simon Willison · RSS 摘要
引用 Felix Rieseberg — Cowork 的"旧"版本在云端运行模型推理,在我们交付到你电脑上的 Anthropic 提供的 VM 中执行工具调用。我们添加 VM 是为了兼顾能力与安全…… Qwen3.8 27B 用文字做加法 — 研究:Qwen3.8 27B 用文字做加法 Colin Frasier 在…
ByteByteGo · RSS 摘要
LLM的盲区:为什么模型会遗忘提示词中间的内容 — 本文将探讨为什么 LLM 对中间位置的信息存在偏见。 倒计时3天:AI 评估,10月期 — 抢占《AI 评估实战》名额,报名仅剩3天!如果你一直在考虑加入,现在就是最佳时机。 EP228: How SSH Works — EP228:SSH 工作原理 安全外壳(SSH…
Sebastian Raschka (Ahead of AI) · RSS 摘要
文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 递归深度、隐藏思维链与循环 Transformer 模块的最新研究综述 Claude 如何为 AI 生成文本添加水印 —…
Fireship (YouTube) · RSS 摘要
唯一一条真正能让你赚钱的 OpenAI 公告…… 一个 50 年前的军事机密是否刚刚解决了 agent prompt injection? DHH 彻底失控了…… Meta 再次转向……Connect 2026 上你错过的一切 WordPress 历史上最昂贵的 33 小时……
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解类似 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内人脑;以及机器诠释学 — AI 当前正撞上的那堵墙,就在身边吗? Import AI 472:DeepMind 的作弊数学智能体;…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度与卫星运行能力。一种新的机器学习系统可以预测哪些地方可能受损…… 介绍 Quine:一个面向生物复杂性的 AI 研究系统 — 生物学不是孤立运作的,对其的 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:基于 Kali Linux 的网络安全工具调用细粒度基准,提供无运行时依赖的可验证奖励 — LLM 正越来越多地应用于网络安全工作流,用于将分析人员的意图转化为工具调用。然而,现有评测仍主要聚焦于知识…… 层次化连续扩散语言模型 — 离散扩散语言模型为需要双向推理与全局约束满足的任务提供了相比自回归…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中悄然消耗加速器容量。我们最大的推荐工作负载处理数百亿训练... AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正逐渐成为用户语义的持久载体以及用户与推荐平台之间的中介,维护着更…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模……的提升,训练损失 $…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能在一夜之间关停一个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、微软与 OpenAI 关系重置、中国开源权重代码能力追平、Agent 接入真实市场,以及 OpenAI 拿下 1220…
Simon Willison · RSS 摘要
我们需要对几乎所有东西设定默认硬性预算上限 — 以下是未来几个月乃至几年世界将大量需要的产品特性:默认硬性预算上限。我说的就是按用量付费…… 九月仅限赞助者订阅的通讯 — 我刚发送了九月版的赞助者专属月刊。如果你已是赞助者(或现在开通赞助),可在此查阅。本期内容:更多 Fable 类模块…… Rex 的恐龙商店 — 博…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 —…
ByteByteGo · RSS 摘要
倒计时 3 天:AI Evals,十月开课 — Secure your spot in AI Evals in Practice. Enrollment closes in just 3 days! If you’ve been thinking about joining, now’s the…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外层 RSI 循环 — 你在哪些方面超出了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器释义学 — AI 正在撞上的那堵墙,就在我们身边吗? Import AI 472:DeepMind 的作弊数学 A…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其形式简洁:随着模型规模扩大,训练损失 L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中静默消耗加速器容量。我们最大的推荐工作负载处理数百亿条训练... AgentWebRec: 基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体,以及用户与推荐平台之间的中介,维护…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一种新的机器学习系统可以预测可能发生损坏的位置…… 介绍 Quine:为生物复杂性而设计的 AI 研究系统 — 生物学不是孤立运作的,其 AI 表示也不应该是孤立的。Quine 是一个早期研究项目,旨在创建生物学的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 的细粒度网络安全工具调用基准,提供免运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,被期望将分析师意图转化为工具调用。然而,现有评测侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理和全局约束满足的任务提供了相较自回归生成的优越替代方案…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁掌控它 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编码平价、Agent 落地真实市场,以及 OpenAI 获 …
Simon Willison · RSS 摘要
我们将需要在几乎所有方面设置默认的硬性预算上限 — 这是一项产品功能——未来数月乃至数年世界将对其需求大增:默认硬性预算上限。我所说的就是按用量付费的功能…… 九月赞助者专属通讯 — 我刚刚发出了九月刊赞助者专属月度通讯。如果你是赞助者(或现在立即开始赞助),可在此访问。本期:更多 Fable 课堂…… Rex 的恐龙…
ByteByteGo · RSS 摘要
EP228:SSH 的工作原理 — SSH 是一种在不安全网络环境中安全访问远程机器的方法。它从 SSH 客户端到远程机器(SSH server)建立 TCP 连接开始。 为什么状态是软件设计中最难处理的事情 — 本文将探讨为什么状态是软件开发中最难处理的问题,以及开发者可用来管理状态的多种策略。 DoorDash 如…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋到 Jev — RNN、CNN、Transformer 与校准的可视化指南,配有关于准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 块近期研究综述 Claude 如何为 AI 生成文本添加水印 …