Notes

笔记

浏览全部笔记 · 1013 篇

3Blue1Brown (YouTube) · RSS 摘要
跳棋钉谜题 64 块方糖谜题 什么是交叉熵?| 压缩即智能 第 2 部分 100 条随机弦,共有多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-08-22 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-22 10:04
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 刚刚突破界限 DeepMind 改变了 AI 感知世界的方式 十亿美元 AI 竞赛格局被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-22 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-22 10:04
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
Tom RSS 摘要 yt-lex-fridman 2026-08-22 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的"mansplainer"(男性说教者) 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-22 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究智能体 Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪一片星系? Import AI …
Jay RSS 摘要 import-ai 2026-08-22 10:03
Microsoft Research Blog · RSS 摘要
拓展 Skala 的可及性,为预测性 DFT 铺就更快的路径 — 微软研究院推出的更新版深度学习交换关联泛函 Skala 1.1,在精度与计算化学领域的可及性上均有提升…… MindTopo 揭示 VLM 的空间推理能力 — 一条小径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立新基准,并展…
Jay RSS 摘要 msr-blog 2026-08-22 10:03
Interconnects (Nathan Lambert) · RSS 摘要
教每个人学会自己"钓" token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何与前沿保持同步 — 提示:这真的不是一个关于蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久能做得更好? — 关于 AI 写作能力以及 AI 模型如何变得更强…
flyP RSS 摘要 interconnects 2026-08-22 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见的坑…… Agents(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial…
Spark RSS 摘要 chip-huyen 2026-08-22 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有智力活动上均能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的实证发现之一。其形式简洁:随着模型规模……的扩大,训…
Jay RSS 摘要 lilian-weng 2026-08-22 10:01
Simon Willison · RSS 摘要
llm 0.32.1 — 发布:llm 0.32.1 几天前 LLM 的全新安装突然无法使用,原因是 OpenAI Python 库放弃了对 httpx 的使用,而 LLM 恰好依赖该库…… llmopenrouter 0.7 — 发布:llmopenrouter 0.7 该插件现已兼容 LLM 0.32,与通过 Op…
Jay RSS 摘要 simon-willison 2026-08-22 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以…
Jay RSS 摘要 nathan-benaich 2026-08-22 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 BrowseCompPlus 投影到 ClimbMix:迈向更真实的 Agentic 搜索语料库 — BrowseCompPlus 基准通过用固定语料库替换不透明的网络搜索,解耦了 Agentic 搜索的评估,从而可将 Agent 的角色与检索器的角色分离…… 怎样的 Fiqh 检索器才算好?面向阿拉伯语伊斯兰教法…
Jay RSS 摘要 cool-papers-ir 2026-08-22 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard: 大语言模型中上下文敏感遗忘的基准评测 — 大语言模型(LLMs)越来越需要对有害或敏感知识进行选择性移除(即遗忘),然而现有方法和基准未能有效评估这一点…… GCARL: 面向患者导向的医疗报告解读的基于检查清单对齐的奖励学习 — 患者对医疗报告的个性化解读需求日益凸显。满足这一需求既需要基…
Jay RSS 摘要 cool-papers 2026-08-22 10:01
Gradient Flow · RSS 摘要
最大的 AI 风险并不在模型内部 — 当前最能揭示问题的 AI 失败案例,并不是关于模型变得过于强大的故事,而是关于模型周围一切的故事。某个系统获得了过多访问权限…… 模型未必是你最大的风险 — 订阅 • 往期内容 最大的 AI 风险并不在模型内部 当前最能揭示问题的 AI 失败案例,并不是关于模型变得过于强大的故事,…
Spark RSS 摘要 gradient-flow 2026-08-22 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 包含数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地编码 Agent — 在本地编码工具中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年…
Jay RSS 摘要 raschka 2026-08-22 10:00
ByteByteGo · RSS 摘要
Schema Evolution:在不破坏现有运行的前提下修改契约 — 本文将介绍 schema evolution 及其相关策略。 GraphRAG:AI 如何回答隐藏在多份文档中的问题 — GraphRAG 正是为应对第二类问题而设计的,本文将详细介绍它。 全新美国 AI 模型,主打可定制化 — 本文将梳理 Thi…
Jay RSS 摘要 bytebytego 2026-08-22 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练的笔记 — 通过中训练与持续预训练打造更优的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对环境建模来构建更好的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Ag…
flyP RSS 摘要 cameron-wolfe 2026-08-22 10:00
Fireship (YouTube) · RSS 摘要
DeepSeek 重返舞台……硅谷为之震动 这个夏天,数学领域也沦陷于机器之手…… 这家新创公司可查询你曾到过的任何地方…… Meta 新模型要求获取你个人生活的"深度访问权限"…… 我在 MIT 待了三天……机器人炒作比你想象的更严重
Jay RSS 摘要 yt-fireship 2026-08-21 10:05
3Blue1Brown (YouTube) · RSS 摘要
跳钉子谜题 64 块方糖谜题 交叉熵到底是什么?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-08-21 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-21 10:04
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬 Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越界 DeepMind 刚刚改变了 AI 看世界的方式 十亿美元 AI 竞赛格局刚刚被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-21 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于后续的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-21 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我造了一个全自动男式说教生成器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-21 10:04
Lex Fridman (YouTube) · RSS 摘要
哈比布·努尔马戈梅多夫:达吉斯坦、MMA、UFC、伊斯兰、康纳、菲多与足球 | Lex Fridman 播客 #500 加里·加拉格尔:美国南北战争、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能…
Tom RSS 摘要 yt-lex-fridman 2026-08-21 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究员 Import AI 468:23 个 RSI 创意;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467…
Jay RSS 摘要 import-ai 2026-08-21 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
rEDMRec: 将大语言模型推理蒸馏为可编辑经验记忆用于推荐 — 大语言模型能够通过对用户历史和候选物品进行显式推理来提升推荐质量,例如提取用户偏好或解释…… ThinktoPersonalize: 统一推理与检索以实现以用户为中心的个性化稠密检索 — 稠密检索通过将查询和物品编码到语义嵌入空间,已成为现代本地生活电…
Jay RSS 摘要 cool-papers-ir 2026-08-21 10:02
Microsoft Research Blog · RSS 摘要
扩展 Skala 的访问性,为预测性 DFT 提供了一条更快路径 — Microsoft Research 推出的更新版深度学习交换相关泛函 Skala 1.1,在计算化学领域提供了更高的准确性和更广泛的访问性 MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 …
Jay RSS 摘要 msr-blog 2026-08-21 10:02
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 $L$ 可预测地下…
Jay RSS 摘要 lilian-weng 2026-08-21 10:02