笔记
浏览全部笔记 · 1809 篇
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 模块近期研究概览 Claude 如何给 AI 生成文本添加水印 — 48 分钟视频讲解:token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
大语言模型强化学习:完整指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进历程…… Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过教会语言智能体建模其环境,构建更优的语言智能体…… Agentic RL:框架与最佳实…
Fireship (YouTube) · RSS 摘要
Google 是否刚刚引爆了智能爆炸? Anthropic 研究人员正在离职……现在我们知道了原因 OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 构建了同一款游戏……只有一个好玩 5 个开源工具替代了我每月 320 美元的 AI 工具栈……
AI Explained (YouTube) · RSS 摘要
AI 研究者看到了什么,才提出"放缓"AI 发展的诉求 GPT 6 Astra:连 OpenAI 都感到担忧 Sam Altman:"2026 年实现 AGI",恰逢模型开始自我"误训练" AI 正在逐渐失控 GPT6 失控?HuggingFace 事件,去除炒作还原真相
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 的惊人新架构 Claude 现在在文本中留下隐形指纹 我从未想过会看到这一幕发生 GPT6 Astra 改变一切 Claude Fable AI 比新闻标题暗示的更离奇
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的框架工程 — 递归自我改进 (RSI) 的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能够在所有智力活动上超越人类的系统…… Scaling Laws 详解 — Scaling laws 是深度学习中最重要的经验发现之一。其核心观察很简单:训练损失 $L$ 会随着模型…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向群体规模发现的高效病理学基础模型 — 如果病理学基础模型能用更少资源做更多事会怎样?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩大 Skala 的访问范围,为预测性 DFT 开辟更快路径…
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹 AI 政策;Forethought 提出 nightwatchman 理论 — 此外,还有一则机器诠释学故事 Import AI 471:为什么 Hugging Face 让我担忧;太空采矿;五眼联盟聚焦 AI — 此外,还有一场与 Robin…
Interconnects (Nathan Lambert) · RSS 摘要
为什么我仍然不相信真正的递归自我改进(RSI) — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开放模型阅读清单 — 如何快速上手了解开放模型及其影响 一次辞职让 AI 恐惧的余烬燃成野火 — 关于真正诡异一周的若干简短笔记 普通民众何时才能感受到 AI 的影响? — 我们身处一场可能延续百年…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇短笔记给出了使用基础模型时一些最常见陷阱的示例…… 智能体(Agents) — Intelligent agents are considered by many to be the ultimate goal of A…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
推理质量至关重要:应对基于LLM的嵌入学习中的推理退化 — 大语言模型(LLMs)近期在生成上下文丰富的文本嵌入用于检索方面展现出强大潜力。现有方法大多将嵌入学习视为…… FacetCRS:面向对话式推荐系统中刺破过滤气泡的多方面偏好学习 — 过滤气泡是推荐系统(RSs)中一个臭名昭著的问题,描述了用户只能接触到有限且…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
嵌入模型以奇特方式进行度量 — 嵌入空间定义了语义相似度与距离的概念。我们研究这些嵌入是否反映质量、距离、时间和体积等物理度量…… 统一在线话语中的群体间敌意模型 — 针对社会群体的敌意言论会将排他行为合理化、为其正名,并助长日益加剧的极化与政治暴力…… JEPAAnything:跨不同世界学习预测模型 — 世界建模使…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、微软与 OpenAI 的重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及 OpenAI 获 1…
Gradient Flow · RSS 摘要
当工作履历成为 AI 资产 — Google 最近同意支付 1000 万美元购买 Spirit Airlines 的内部业务数据。该航空公司虽然已破产,但其电子邮件、Teams 消息、软件、电子表格以及 o… Google 刚刚花费 1000 万美元购买了一家航空公司的 Teams 消息记录 — 订阅 • 往期内容 当…
Simon Willison · RSS 摘要
datasetteauthgithub 1.0 — 发布:datasetteauthgithub 1.0。我在 agent.datasette.io 演示站点运行这个 GitHub 登录插件,发现认证会话持续时间不长。原来…… 加州海狮、勃兰特鹚 — 加州海狮、勃兰特鸬鹚,摄于美国加州 Pillar Point 港。拍…
ByteByteGo · RSS 摘要
EP226:每位软件工程师都应了解的 API 概念 — 发送请求并读取 JSON 是一回事;设计一个他人可以依赖的 API,则是另一件复杂得多的事情。 大规模迁移:在 30000 英尺高空更换应用引擎 — 本文将探讨大规模迁移如何运作,以及能让迁移尽可能高效的关键策略。 LLM 如何在大海捞针 — 本文将探讨 LLM …
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 探讨循环深度、隐式思维链及循环 Transformer 块的最新研究 Claude 如何对 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完整指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进 中期训练札记 — 通过中期训练与持续预训练打造更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更优的语言 Agent Agent 强化学习:框架与最佳实践 — LLM 如何被训练以应对复杂环境…
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:迈向人群规模发现的高效病理基础模型 — 如果病理基础模型能以更少资源做更多事会怎样?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低了算力需求,为……打开了大门 扩大 Skala 的可访问性,为预测性 DFT 开辟更快路径 …
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 Agent;民粹 AI 政策;Forethought 提出守夜人理论 — 此外,一则机器诠释学故事 Import AI 471:为何 Hugging Face 让我担忧;太空采矿;五眼联盟关注 AI — 此外,与 Robin Sloan 的线下活动! Impor…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的驾驭工程 — 递归自我改进(RSI)的概念最早可追溯到 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类…… 审慎看待扩展定律 — 扩展定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模…… 为何思考 — Special thanks to John S…
Interconnects (Nathan Lambert) · RSS 摘要
开源 AI 与开放模型阅读清单 — 如何快速上手了解开放模型及其影响 一次辞职让 AI 恐惧的余烬燃成燎原大火 — 对这个真正诡异一周的若干简记 普通大众何时会感受到 AI 的影响? — 我们正身处一场可能持续百年的复利革命的开头 5 年,以及 AI 行业应如何应对 最新开放成果(第 24 期):Motif3、GLM5…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文是一篇短文,列举了一些最常见陷阱的示例…… Agents(智能体) — 智能体(Intelligent agents)被许多人视为 AI 的终极目标。Stuart Russell 和 Pe…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开源权重模型的代码能力追平、Agent 落地真实市场,以及 OpenAI 的 …
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 块最新研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解:token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 R…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
推理质量至关重要:抵御基于LLM嵌入学习中的推理崩溃 — LLM最近在生成上下文丰富的文本嵌入以用于检索方面展现出强大潜力。大多数现有方法要么将嵌入学习视为... FacetCRS:刺破对话式推荐系统中过滤气泡的多方面偏好学习 — 过滤气泡是推荐系统(RS)中一个臭名昭著的问题,它描述了用户接触到的信息或内容范围有限且…
ByteByteGo · RSS 摘要
大规模迁移:在 30,000 英尺高空更换应用引擎 — 本文将探讨大规模迁移的工作原理,以及帮助其尽可能高效的关键策略。 LLM 如何在大海中捞针 — 本文将探讨 LLM 如何在大海中捞针。 报名最后机会:Build with Claude Code — 我们正在重新推出 Build with Claude Code,…
Simon Willison · RSS 摘要
Gemini 攻破三家企业,Google AI 首次实现已知的越狱突破 — Gemini 终于在 Felony Bench 上取得突破!该公司于周五确认,这些攻击发生在 5 月…… 2026 年 9 月 18 日备注 — 作为一名计算机科学家,现在拒绝承认 LLM 有任何有趣之处,有点像遗传学家拒绝承认最近的…… 引用…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
嵌入模型以奇特的方式进行度量 — 嵌入空间定义了语义相似度和距离的概念。我们研究这些嵌入是否反映质量、距离、时间和体积的物理度量… 在线话语中群体间敌意的统一建模 — 针对社会群体的敌对言论可以将排斥行为正常化,为不当对待正名,同时加剧日益严重的极化和政治暴力。旨在缓和此类… JEPAAnything:跨不同世界学习预…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 的强化学习:完整指南 — 从第一性原理出发,追溯强化学习至现代 AI 研究前沿的演进历程…… 关于中间训练(Midtraining)的笔记 — 通过中间训练与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其环境,构建更优的语言 Agent…… Agentic R…