研究库 精读笔记
Notes

笔记

浏览全部笔记 · 1809 篇

Gradient Flow · RSS 摘要
当工作履历成为 AI 资产 — Google 近日同意支付 1000 万美元购买 Spirit Airlines 的内部业务数据。该航司已破产,但其邮件、Teams 消息、软件、电子表格以及其他…… Google 刚花 1000 万美元买下了一家航司的 Teams 消息 — 订阅 • 往期内容 当工作履历成为 AI 资…
Spark RSS 摘要 gradient-flow 2026-09-19 10:00
AI Explained (YouTube) · RSS 摘要
AI 研究者在呼吁"放缓"AI 发展之前看到了什么 GPT6 Astra:强大到连 OpenAI 都感到担忧 [Sam Altman:"2026 年实现 AGI",恰逢模型开始[误]自我训练]( AI 开始有些失控 GPT6 失控?HuggingFace 事件,剥离炒作
flyP RSS 摘要 yt-ai-explained 2026-09-18 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 agent;民粹主义 AI 政策;Forethought 提出 nightwatchman 理论 — 附:一个机器诠释学的故事 Import AI 471:Hugging Face 让我担忧的原因;太空采矿;五眼联盟关注 AI — 附:与 Robin Sloan…
Jay RSS 摘要 import-ai 2026-09-18 10:02
Microsoft Research Blog · RSS 摘要
GigaPathFlash 和 GigaTIMEFlash:迈向人群规模发现的高效病理基础模型 — 如果病理基础模型能以更少资源做更多呢?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为……打开了大门 扩展 Skala 的可访问性,为预测性 DFT 铺就更快路径 — 微软…
Jay RSS 摘要 msr-blog 2026-09-18 10:02
Interconnects (Nathan Lambert) · RSS 摘要
开源 AI 与开放模型阅读清单 — 如何快速了解开放模型及其影响 一场辞职将 AI 担忧的余烬燃成野火 — 对一个真正诡异之周的简短笔记 普通大众何时才能感受到 AI 的影响? — 我们身处一场可能持续百年的复利式革命的开头 5 年,以及 AI 行业应如何应对 最新开放制品(第 24 期):Motif3、GLM5.3、…
flyP RSS 摘要 interconnects 2026-09-18 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错在所难免。这篇短文列举了一些最常见陷阱的示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artific…
Spark RSS 摘要 chip-huyen 2026-09-18 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
SURF: Subtractive Updates for Recommender Forgetting — 用户隐私需求的持续增长以及 GDPR 等法规的合规要求,使机器遗忘成为现代推荐系统的基本需求。然而,…… 探索 LLMs 和 RAG 在车辆部件合理且可解释材料预测中的应用 — 本工作旨在探索 LLMs 是否能…
Jay RSS 摘要 cool-papers-ir 2026-09-18 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 L 可…
Jay RSS 摘要 lilian-weng 2026-09-18 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型实现代码能力对等、Agent 走向真实市场,以及 …
Jay RSS 摘要 nathan-benaich 2026-09-18 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Objective vs. Search:拆解一个好的 Tokeniser 的构成要素 — 现代语言模型主要使用两种 tokenisation 算法:BPE 与 UnigramLM。它们沿两条正交轴存在差异:优化目标…… 一种用于 LLM 偏好对齐的零阶范式 — 直接偏好对齐方法因其计算与显存效率而被广泛用于将 LLM…
Jay RSS 摘要 cool-papers 2026-09-18 10:01
Gradient Flow · RSS 摘要
当工作履历成为 AI 资产 — Google 最近同意支付 1000 万美元购买 Spirit Airlines 的内部业务数据。该航空公司已破产,但其邮件、Teams 消息、软件、电子表格及其他…… 所以 Google 刚花 1000 万美元买下了一家航空公司的 Teams 消息 — 订阅 • 往期 当工作履历成为 …
Spark RSS 摘要 gradient-flow 2026-09-18 10:01
ByteByteGo · RSS 摘要
大规模迁移:在三万英尺高空更换应用引擎 — 本文将探讨大规模迁移的工作原理,以及帮助提升迁移效率的关键策略。 LLM 如何在大海捞针 — 本文将探讨 LLM 如何在大海捞针。 招生最后机会:Build with Claude Code — 我们正在重新启动 Build with Claude Code,这是一门为期两天…
Jay RSS 摘要 bytebytego 2026-09-18 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、Looped Transformers 与隐藏推理 — 循环深度、隐藏思维链与 Looping Transformer 块研究综述 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与移除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训…
Jay RSS 摘要 raschka 2026-09-18 10:00
Simon Willison · RSS 摘要
警惕:针对知名 Rustaceans 的定向攻击 — Adam Harvey 与 crates 安全团队发布重要警告:我们认为存在针对 rustlan… 的持续攻击活动 如何用 LLM 写作 — Thomas Ptacek 谈如何把 LLM 当作文字编辑而非写作助手:第一条规则是,你不得使用 LLM 建议的任何字词。[…
Jay RSS 摘要 simon-willison 2026-09-18 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM的强化学习:完整指南 — 从第一性原理出发,追溯RL从基础原理到现代AI研究前沿的演进历程... Midtraining笔记 — 通过midtraining与持续预训练构建更优的专用LLM... Agentic World Models(智能体世界模型) — 通过教会语言Agent建模其环境,构建更优的语言智能体…
flyP RSS 摘要 cameron-wolfe 2026-09-18 10:00
Fireship (YouTube) · RSS 摘要
Anthropic 研究人员正在离职……现在我们知道原因了 OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 构建了同一款游戏……只有一个好玩 5 个开源工具,替代了我每月 320 美元的 AI 工具栈…… OpenAI 真的实现 AGI 了吗?GPT6 Astra 首发评测
Jay RSS 摘要 yt-fireship 2026-09-17 10:04
Lex Fridman (YouTube) · RSS 摘要 · 2026-09-17(v2 重写覆盖)
v1 → v2 修复 模式 BQ(RSSYouTube 信源无过滤最低交付)治理第三棒 · 9 行 5 标题纯列表 → 1 高价值 + 3 邻接 + 1 低价值三档分档 · 元信息段补全 · DHH #501 复用 916 v2 范式 + 增补 4 条新条目深挖(精神病学 #502 反向工程 + Khabib #500…
Tom RSS 摘要 yt-lex-fridman 2026-09-17 10:04
3Blue1Brown (YouTube) · RSS 摘要
跳钉子谜题 64 块方糖谜题 什么是 crossentropy?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-09-17 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究像 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-09-17 10:03
AI Explained (YouTube) · RSS 摘要
AI 研究者在呼吁"为 AI 踩刹车"之前所看到的 GPT 6 Astra 强到连 OpenAI 都感到担忧 [Sam Altman:"2026 年实现 AGI",恰逢模型开始自我[错误]训练]( AI 正变得有些失控 GPT6 失控?HuggingFace 事件还原
flyP RSS 摘要 yt-ai-explained 2026-09-17 10:03
Yannic Kilcher (YouTube) · RSS 摘要 · 2026-09-17(v2 重写覆盖)
v1 → v2 修复 模式 BQ(RSSYouTube 信源无过滤最低交付)治理第二棒 · 5 标题纯列表 → 1 高价值 + 2 邻接 + 2 低价值三档分档 · 元信息段补全 · TiDAR / Titans 两条论文解读深挖(与 917 radar 候选 #4 Register Tokens + 915 rada…
Tom RSS 摘要 yt-yannic-kilcher 2026-09-17 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 在数学任务中作弊的智能体;民粹主义 AI 政策;Forethought 提出"守夜人"理论 — Plus:一则机器诠释学(machine hermeneutics)故事 Import AI 471:Hugging Face 为何令我担忧;太空采矿;五眼联盟聚焦 AI — P…
Jay RSS 摘要 import-ai 2026-09-17 10:02
Microsoft Research Blog · RSS 摘要
GigaPathFlash 和 GigaTIMEFlash:迈向基于高效病理学基础模型的人群规模发现 — 如果病理学基础模型能用更少资源做更多事会怎样?GigaPathFlash 和 GigaTIMEFlash 在保持强劲性能的同时降低了算力需求,为……打开了大门 扩大 Skala 的可及性,为预测性 DFT 开辟更快…
Jay RSS 摘要 msr-blog 2026-09-17 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这篇短文通过示例介绍了一些最常见的 pitfa… Agent — 许多人认为智能 Agent 是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Ar…
Spark RSS 摘要 chip-huyen 2026-09-17 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简单:随模型规模扩大,训练损失 L 可预测…
Jay RSS 摘要 lilian-weng 2026-09-17 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
大规模推荐系统中用于检索的高效 Swing 计算 — 给定一个用户物品图 $G$、一个查询物品 $v_q$ 和一个目标物品 $v_t$,物品对 $(v_q, v_t)$ 的 Swing 分数 $sw(v_q, v_t)$ 利用用户物品用户的交互结构…… AURA:大规模生产推荐系统中的智能体诊断与优化 — 一个推荐系统…
Jay RSS 摘要 cool-papers-ir 2026-09-17 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LLM 应该在何时弃答?面向选择性风险控制的自我追问链 — 当事实依据薄弱时,大语言模型仍会生成流畅回答。本文提出 ChainofSelfQuestioning (CoSQ),一种仅依赖 prompt 的框架,使答案…… 智能家居中剪枝会破坏什么,何时发生?跨架构与任务复杂度的 LLM 性能退化评估 — 剪枝可降低大语…
Jay RSS 摘要 cool-papers 2026-09-17 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开源 AI 与开放模型阅读清单 — 如何快速上手开放模型及其影响 一场辞职让 AI 恐惧的余烬燃成燎原大火 — 对这周诡异事件的简短笔记 普通人群何时才能切实感受到 AI 的影响? — 这场可能延续百年的复利式革命才进入不到五年,AI 行业应如何应对 最新开放产物(第 24 期):Motif3、GLM5.3、Hy4pr…
flyP RSS 摘要 interconnects 2026-09-17 10:01
Simon Willison · RSS 摘要
datasette 1.0a40 — 发布:datasette 1.0a40,包含与 0.65.5 相同的安全修复,以及一些新功能和 Bug 修复:插件现在可使用新的 datasette.add_ba… 来启动和管理后台任务 datasette 0.65.5 — 发布:datasette 0.65.5,修复一个安全问题…
Jay RSS 摘要 simon-willison 2026-09-17 10:00
ByteByteGo · RSS 摘要
LLM 如何在海量信息中精准定位关键内容 — 本文将探讨 LLM 如何在大海般的文本中找到关键信息。 招生最后机会:Build with Claude Code — 我们重新推出 Build with Claude Code,这是一门为期两天的密集型小班课程,由 John Kim 授课,他曾在 Meta 为数百名工程师…
Jay RSS 摘要 bytebytego 2026-09-17 10:00