Notes

笔记

浏览全部笔记 · 1013 篇

Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 慎思 Scaling Laws — Scaling laws 是深度学习中最关键的经验发现之一。其观察形式简洁:随模型规模扩大,训练损失 $L$ …
Jay RSS 摘要 lilian-weng 2026-08-24 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard:面向大语言模型的上下文敏感遗忘能力基准测试 — 大语言模型(LLM)日益需要对有害或敏感知识进行选择性移除(即遗忘),但现有方法和基准未能有效评估这一能力…… GCARL:面向患者导向医学报告解读的、基于证据且对齐清单的奖励学习 — 患者对医学报告的个性化解读需求日益凸显。满足该需求既需要基于…
Jay RSS 摘要 cool-papers 2026-08-24 10:01
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己"钓" token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟 SOTA 前沿 — 提示:它并非一个关于蒸馏的故事。 我写了一本 AI 教材——还要多久 AI 能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变…
flyP RSS 摘要 interconnects 2026-08-24 10:01
Gradient Flow · RSS 摘要
AI 最大的风险来自模型之外 — 当前最暴露问题的 AI 失败案例,并非关于模型变得过于强大,而是围绕模型的一切。其中一个系统获得了超出预期的访问权限…… 模型未必是你最大的风险 — 订阅 • 往期 The biggest AI risks sit outside the model 当前最暴露问题的 AI 失败案例,…
Spark RSS 摘要 gradient-flow 2026-08-24 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁的方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 重置、中国开放权重模型的编程能力对标、Agent 接入真实市场,以及 Open…
Jay RSS 摘要 nathan-benaich 2026-08-24 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
Claude 如何对 AI 生成文本进行水印 — 一个 48 分钟的视频教程,讲解 token 采样、水印检测与移除 从零构建 AI 文本检测器 — 一个端到端项目,包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理投入度 — LLM 如何学习低、中、高投入度的推理模式 使用本地 Coding Age…
Jay RSS 摘要 raschka 2026-08-24 10:00
Simon Willison · RSS 摘要
Anthropic 最好的 AI 模型难以吸引用户,而更便宜的工具却蓬勃发展 — Anthropic 最好的 AI 模型难以吸引用户,而更便宜的工具却蓬勃发展。这篇 FT 报道从"知情人士"处收集了一些有趣的数字:Anthro… 引用 Drew Breunig 的话 — 在 Fable 之前,花太多时间改进编码工具链或…
Jay RSS 摘要 simon-willison 2026-08-24 10:00
ByteByteGo · RSS 摘要
EP223:Ollama vs vLLM vs SGLang — 要在本机上使用开放权重模型,你有三种主要选择:Ollama、vLLM 和 SGLang。但每种引擎处理请求的方式各不相同。 Schema Evolution:在不破坏运行的前提下变更契约 — 本文将介绍 Schema Evolution 及其相关策略。 …
Jay RSS 摘要 bytebytego 2026-08-24 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中间训练(Midtraining)笔记 — 通过中间训练与持续预训练构建更优专用 LLM…… Agentic 世界模型 — 通过让语言 agents 对环境建模来构建更优语言 agents…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详细指南 — …
flyP RSS 摘要 cameron-wolfe 2026-08-24 10:00
Fireship (YouTube) · RSS 摘要
DeepSeek 强势回归……硅谷为之震动 这个夏天,数学输给了机器…… 这家新创公司可以查询你去过的任何地方…… Meta 的新模型想要"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更严重
Jay RSS 摘要 yt-fireship 2026-08-23 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:初步结果 Claude Fable 被封禁 —— 后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-23 10:04
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
Tom RSS 摘要 yt-lex-fridman 2026-08-23 10:04
3Blue1Brown (YouTube) · RSS 摘要
跳钉子谜题 64块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-08-23 10:04
Andrej Karpathy (YouTube) · RSS 摘要
如何使用 LLM 深入解读像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-23 10:03
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 越界了 DeepMind 改变了 AI 看世界的方式 十亿美元 AI 竞赛被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-23 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我做了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-23 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究者 Import AI 468:23 个 RSI 想法;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467…
Jay RSS 摘要 import-ai 2026-08-23 10:02
Microsoft Research Blog · RSS 摘要
扩展 Skala 的可及性,为预测性 DFT 提供更快路径 — Skala 1.1 是来自 Microsoft Research 的更新版深度学习交换关联泛函,在计算化学领域带来了更高精度和更广的可及性…… MindTopo 揭示了 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 A…
Jay RSS 摘要 msr-blog 2026-08-23 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错在所难免。本文简要列举了一些最常见 pitfa……的示例 Agents — 许多人认为 intelligent agents 是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artifici…
Spark RSS 摘要 chip-huyen 2026-08-23 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 BrowseCompPlus 投影到 ClimbMix:迈向更真实的 Agentic Search 语料库 — BrowseCompPlus 基准通过用固定语料库替代不透明的网络搜索,解耦了 Agentic search 的评估,从而可将 Agent 的角色与检索器的作用分离开来…… 怎样的 Fiqh 检索器才算优…
Jay RSS 摘要 cool-papers-ir 2026-08-23 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为能够在……方面超越人类的系统。 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型……规模的扩大,训练…
Jay RSS 摘要 lilian-weng 2026-08-23 10:01
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家如何获取 token — Nvidia 希望用户自建模型,而非从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这其实并非一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 …
flyP RSS 摘要 interconnects 2026-08-23 10:01
Simon Willison · RSS 摘要
引用 Linus Torvalds 的话 — 这是一次地狱般的 debug 会话,多亏 AI 承担了大量苦力活。我本想称它为不知疲倦的助手,但 AI 几次都直接断言它…… llm 0.33 — 发布:llm 0.33 本版本亮点:将 OpenAI Python 库升级到 3.x,并将 HTTP 客户端依赖从 httpx…
Jay RSS 摘要 simon-willison 2026-08-23 10:00
ByteByteGo · RSS 摘要
EP223:Ollama vs vLLM vs SGLang — 在本地运行开源权重模型,主要有 Ollama、vLLM 和 SGLang 三种选择,但各引擎处理请求的方式不同。 Schema 演进:在不破坏现有运行的前提下修改契约 — 本文将介绍 Schema 演进及其相关策略。 GraphRAG:AI 如何回答跨多…
Jay RSS 摘要 bytebytego 2026-08-23 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
Claude 如何给 AI 生成文本打水印 — 一段 48 分钟的视频讲解,覆盖 token 采样、水印检测与移除 从零构建一个 AI 文本检测器 — 一个端到端项目:包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent…
Jay RSS 摘要 raschka 2026-08-23 10:00
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard:面向大语言模型上下文敏感遗忘的基准评测 — 大语言模型(LLM)越来越需要选择性地移除有害或敏感知识,即遗忘机制,但现有方法和基准未能有效评估这一点…… GCARL:面向以患者为中心的医学报告解读的、基于检查清单对齐的奖励学习 — 针对医学报告的个性化解读已成为患者日益迫切的需求。满足该需求既…
Jay RSS 摘要 cool-papers 2026-08-23 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题的关键不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的编程能力对等、Agent 接触真…
Jay RSS 摘要 nathan-benaich 2026-08-23 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 Midtraining 的笔记 — 通过 midtraining 和 continual pretraining 构建更好的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 学习建模其环境来构建更好的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂…
flyP RSS 摘要 cameron-wolfe 2026-08-23 10:00
Gradient Flow · RSS 摘要
最大的 AI 风险存在于模型之外 — 当前最值得关注的 AI 失败案例,并非关于模型变得过于强大,而是围绕模型的一切。某个系统获得了超出预期的访问权限…… 模型未必是你最大的风险 — 订阅 • 往期内容 最大的 AI 风险存在于模型之外 当前最值得关注的 AI 失败案例,并非关于模型变得过于强大,而是围绕模型的一切………
Spark RSS 摘要 gradient-flow 2026-08-23 10:00
Fireship (YouTube) · RSS 摘要
DeepSeek 重返战场... 硅谷为之胆寒 数学被机器击败的那个夏天... 这家新创公司可以查询你去过的任何地方... Meta 新模型要求对你的个人生活拥有"深度访问"权限... 我在 MIT 待了三天... 机器人的炒作比你想的更离谱
Jay RSS 摘要 yt-fireship 2026-08-22 10:05