研究库 精读笔记
Notes

笔记

浏览全部笔记 · 1809 篇

Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐式推理 — 解析循环深度、隐式思维链与循环 Transformer 块的近期研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解:token 采样、水印检测与移除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与 …
Jay RSS 摘要 raschka 2026-09-15 10:00
ByteByteGo · RSS 摘要
LLM 作为评判者:如何判断你的 LLM 是否健康 — 本文将详细介绍 LLM 评估的流程。 EP225:为什么 git revert 会引发冲突? — git revert 看起来很简单,直到它抛出冲突 学习 Claude Code、评测、AI 系统等:ByteByteGo Live 正式上线 — 大多数在线课程从未…
Jay RSS 摘要 bytebytego 2026-09-15 10:00
Simon Willison · RSS 摘要
恐惧的蔓延 — 恐惧的蔓延:Bryan Cantrill 回应前 Anthropic 员工 Jacob Coxon 的推文,确认许多 Anthropic 研究人员相信 AI"可能毁灭我们所有人…… 哪些博文对你的思维影响最大? — 我对"哪些博文对你的思维影响最大?"的评论 — Lobste.rs。对我而言,Joel …
Jay RSS 摘要 simon-willison 2026-09-15 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 追溯强化学习从基本原理到现代 AI 研究前沿的演进历程... 关于中训练(Midtraining)的笔记 — 通过中训练与持续预训练打造更优的专用 LLM... Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更优的语言 Agent... Agentic RL:框架…
flyP RSS 摘要 cameron-wolfe 2026-09-15 10:00
Fireship (YouTube) · RSS 摘要
OpenAI 最大的数学突破正陷入困境…… 我用 Astra 和 Fable 5.1 做了同一款游戏……只有一个真正好玩 5 个开源工具替代了我每月 320 美元的 AI 工具栈…… OpenAI 真的造出 AGI 了吗?GPT6 Astra 首发评测 史上最有意思的黑客事件变得更加离奇……
Jay RSS 摘要 yt-fireship 2026-09-14 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 我们来复现 GPT2 (124M) 我们来构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-09-14 10:04
Two Minute Papers (YouTube) · RSS 摘要
没想到这种事竟然发生了 GPT6 Astra 改变了一切 Claude Fable AI 远比头条所暗示的更离奇 GLM 5.3:强大的 AI 正变得几乎免费 价值十亿美元的 AI 差距正在崩塌
flyP RSS 摘要 yt-two-minute-papers 2026-09-14 10:04
AI Explained (YouTube) · RSS 摘要
GPT 6 Astra,表现优秀,连 OpenAI 都感到担忧 [Sam Altman:"2026 年实现 AGI",恰逢模型开始自我[错误]训练]( AI 正在逐渐失控 GPT6 失控?HuggingFace 事件,去除炒作还原真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规…
flyP RSS 摘要 yt-ai-explained 2026-09-14 10:04
Lex Fridman (YouTube) · RSS 摘要
DHH: 编程、AI、Agentic Engineering、Vibe Coding 与 Linux 的未来 | Lex Fridman 播客 #501 Khabib Nurmagomedov: 达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary …
Tom RSS 摘要 yt-lex-fridman 2026-09-14 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在 Diffusion 中思考,在 Autoregression 中生成(论文解析) Titans:学习在测试时记忆(论文解析)
Tom RSS 摘要 yt-yannic-kilcher 2026-09-14 10:04
3Blue1Brown (YouTube) · RSS 摘要
跳钉谜题 64块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 衡量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-09-14 10:04
Microsoft Research Blog · RSS 摘要
GigaPathFlash 与 GigaTIMEFlash:面向大规模人群发现的高效病理基础模型 — 如果病理基础模型能以更少资源做更多事会怎样?GigaPathFlash 与 GigaTIMEFlash 在保持强劲性能的同时降低算力需求,为…… 扩大 Skala 的可及性,加速预测性 DFT 的应用 — Skala …
Jay RSS 摘要 msr-blog 2026-09-14 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 472:DeepMind 的作弊数学 agent;民粹主义 AI 政策;Forethought 理论化一个守夜人 — 另外,一则机器释义学故事 Import AI 471:为什么 Hugging Face 让我担忧;太空采矿;五眼联盟关注 AI — 另外,与 Robin Sloan 的直播活动! I…
Jay RSS 摘要 import-ai 2026-09-14 10:02
Interconnects (Nathan Lambert) · RSS 摘要
开源 AI 与开放模型阅读清单 — 如何快速了解开放模型及其影响。 一场辞职让 AI 恐惧的余烬燃成燎原大火 — 关于一个真正诡异之周的简要笔记。 普通大众何时会感受到 AI 的影响? — 我们身处一场可能延续百年的复利式革命尚不足 5 年,以及 AI 行业应如何应对。 最新开放产物(第 24 期):Motif3、GL…
flyP RSS 摘要 interconnects 2026-09-14 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错实属正常。本文是一篇简短笔记,通过示例介绍一些最常见的陷阱…… Agents — Intelligent agents 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Art…
Spark RSS 摘要 chip-huyen 2026-09-14 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Transformers中的距离泛化:为何还要使用位置编码? — 分布外长度泛化,即从短上下文外推到更长上下文的能力,已在Transformer中被广泛研究。本文聚焦于距离泛化…… NuhaSpeech:构建通用阿拉伯语语音LLM — 随着语音大语言模型(speechLLMs)的多语种能力不断增强,阿拉伯语仍明显代表性…
Jay RSS 摘要 cool-papers 2026-09-14 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式简洁:当我们扩大模型…… 我们为何思考…
Jay RSS 摘要 lilian-weng 2026-09-14 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
生成式晚期交互嵌入用于视觉文档检索 — 晚期交互检索是视觉文档搜索的 SOTA 方法,但其精度以存储为代价。现有压缩方法保留子集或局部平均…… 你的检索器已经知道:面向 RAG 检索充分性的分布形状 QPP — 标准 RAG 流水线通常无法在推理时提供检索是否成功的可靠信号;在模糊或超出范围的查询上,生成器…… Fed…
Jay RSS 摘要 cool-papers-ir 2026-09-14 10:01
Gradient Flow · RSS 摘要
抛开科幻色彩的自我改进 — 几周前我写过 AI 系统在部署后持续学习、而非把每次交互都视为全新开始的文章。这促使一些读者对递… 你的 AI 模型是租来的(但闭环才是资产) — 订阅 • 往期 抛开科幻色彩的自我改进 几周前我写过 AI 系统在部署后持续学习、而非把每次交互都视为全新开始的文章…… 中国 AI 的内卷 —…
Spark RSS 摘要 gradient-flow 2026-09-14 10:01
Simon Willison · RSS 摘要
commitrewriter 0.1 — 发布:commitrewriter 0.1。前几天我写了这个小 Web 应用,用来编辑 Datasette 安全发布的 commit 信息。最初的 commit 信息中充斥着编码…… shotscraper 1.12 — 发布:shotscraper 1.12。为我的截图自动化…
Jay RSS 摘要 simon-willison 2026-09-14 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型实现代码能力持平、Agent 走入真实市场…
Jay RSS 摘要 nathan-benaich 2026-09-14 10:00
ByteByteGo · RSS 摘要
EP225:为什么 Git Revert 会引发冲突? — git revert 看起来很简单,直到它抛出冲突。 学习 Claude Code、evals、AI 系统等:ByteByteGo Live 上线了。 — 大多数在线课程从未被学完(完成率约 4%)。直播课程完成率约 40%,高出近 10 倍。直播课程是人们唯…
Jay RSS 摘要 bytebytego 2026-09-14 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
GPT6 Astra、循环 Transformer 与隐藏推理 — 解析循环深度、隐藏思维链及循环 Transformer 模块的最新研究 Claude 如何为 AI 生成文本添加水印 — 48 分钟视频详解 token 采样、水印检测与去除 从零构建 AI 文本检测器 — 端到端项目:数据集构建、模型训练、本地部署与…
Jay RSS 摘要 raschka 2026-09-14 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
面向 LLM 的强化学习:完整指南 — 从第一性原理出发,追溯强化学习迈向现代 AI 研究前沿的演进历程... Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优秀的专用 LLM... Agentic 世界模型 — 通过让语言 Agent 学会对其环境进行建模,打造更出色的语言 Age…
flyP RSS 摘要 cameron-wolfe 2026-09-14 10:00
Fireship (YouTube) · RSS 摘要
OpenAI 最大的数学突破正在翻车... 我用 Astra 和 Fable 5.1 做了同一款游戏...只有一个好玩 5 个开源工具替代了我每月 320 美元的 AI 工具栈... OpenAI 真的实现 AGI 了吗?GPT6 Astra 首发上手 史上最离奇的黑客事件变得更加诡异...
Jay RSS 摘要 yt-fireship 2026-09-13 10:04
Lex Fridman (YouTube) · RSS 摘要
DHH: 编程、AI、Agentic Engineering、Vibe Coding 与 Linux 的未来 | Lex Fridman 播客 #501 Khabib Nurmagomedov: 达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary …
Tom RSS 摘要 yt-lex-fridman 2026-09-13 10:04
3Blue1Brown (YouTube) · RSS 摘要
跳棋钉难题 64块方糖难题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-09-13 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-09-13 10:03
AI Explained (YouTube) · RSS 摘要
GPT 6 Astra,效果出色连 OpenAI 都感到担忧 [Sam Altman:"2026 年实现 AGI",恰逢模型开始自我[错误]训练]( AI 正在逐渐失控 GPT6 失控?HuggingFace 事件,去除炒作还原真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则
flyP RSS 摘要 yt-ai-explained 2026-09-13 10:03
Two Minute Papers (YouTube) · RSS 摘要
我从未想过会看到这一幕发生 GPT6 Astra 改变一切 Claude Fable AI 比头条所暗示的更加离奇 GLM 5.3:强大的 AI 正在变得几乎免费 十亿美元级 AI 差距正在崩塌
flyP RSS 摘要 yt-two-minute-papers 2026-09-13 10:03