Notes

笔记

浏览全部笔记 · 1033 篇

AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作的解读 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 11 个关于下一步走向的低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-14 10:03
Two Minute Papers (YouTube) · RSS 摘要
OpenAI的AI Agent突破新界限 DeepMind改写AI视觉认知 十亿美元AI竞赛格局生变 又一个DeepSeek时刻来临 NVIDIA的AI明白:单纯模仿人类远远不够
flyP RSS 摘要 yt-two-minute-papers 2026-08-14 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-14 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 构想;PostTrainBench+;信任与透明度如何与 AI 竞赛相互交织 — 你会选择哪个星系? Import AI 467:自持型 AI 病毒;AI 发展节奏的调控;对 AI 与创造力的困惑 — 我们何时建造月球生态城? Import AI 466:机器人领域的"苦涩…
Jay RSS 摘要 import-ai 2026-08-14 10:02
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路、一道围栏、一个结。MindTopo 为测试 AI 理解拓扑关系建立了新基准,并凸显了强化空间推理的新机遇…… CAREX 介绍:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成。CAREX 探索统一方法,…
Jay RSS 摘要 msr-blog 2026-08-14 10:02
Interconnects (Nathan Lambert) · RSS 摘要
我写了一本AI教科书——AI还需要多久才能写得比我更好? — 对AI写作能力的反思,以及AI模型如何变得更强。 你将在我的新posttraining教科书中学到的5个实用要点(即日上线!) — 历经数年抽时间整理我从训练开源模型中总结的经验,posttraining书终于完成! 来自hack的经验 — 关于模型alig…
flyP RSS 摘要 interconnects 2026-08-14 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见的陷阱…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 所著的经典教材《Artifi…
Spark RSS 摘要 chip-huyen 2026-08-14 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模扩大,训练损失 $…
Jay RSS 摘要 lilian-weng 2026-08-14 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
让协同信号发挥作用:面向序列推荐的图感知大语言模型 — LLM 已被广泛用作推荐系统的主干网络。然而其以语言为中心的预训练方式难以捕捉协同… 面向生成式文档检索的 token 级信用分配优化 — 生成式检索模型通过自回归生成文档标识(DocID)来完成文档检索。该过程天然构成序贯决策问题,其中… HCGRec:基于 S…
Jay RSS 摘要 cool-papers-ir 2026-08-14 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
结构性沉默:当 AI 基础设施辜负低资源语言使用者时 — AI 教育与语言支持工具日益被定位为可扩展方案,用于弥合资源不足社区的可及性差距。然而,相关基础设施…… 用于检测公共采购中指控性语言的级联无监督监督 NLP 流水线 — 公共采购涉及大额财政资源分配,因此需要通过审计、控制与监督机制进行持续监管。然…… 一个冻…
Jay RSS 摘要 cool-papers 2026-08-14 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力对等、Agent 落地真实市场,以及 Open…
Jay RSS 摘要 nathan-benaich 2026-08-14 10:01
Gradient Flow · RSS 摘要
持续学习正以碎片化形式到来 — 之前我写过初创公司如何用强化学习让 Agent 更可靠。这一趋势背后一个更深层的问题不断浮现:模型可以改进…… 为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正以碎片化形式到来 之前我写过初创公司如何用强化学习让 Agent 更可靠。一个更深层的问题…… 为…
Spark RSS 摘要 gradient-flow 2026-08-14 10:01
ByteByteGo · RSS 摘要
API组合技术详解指南 — 本文将深入探讨API组合问题及其相关模式。 GitHub vs Vercel vs Replit:当AI代码成本降低时,开发平台何去何从 — AI模型已在很大程度上解决了软件开发中的代码编写问题。 Cloudflare如何让AI为内容付费 — 本文将从以下五个步骤介绍Cloudflare的解…
Jay RSS 摘要 bytebytego 2026-08-14 10:00
Simon Willison · RSS 摘要
sqliteutils 4.2.1 — 发布:sqliteutils 4.2.1 修复 sqliteutils 4.2 中的一个崩溃 bug。引入的代码类似 from typing_extensions import Self,结果 typingextensi… sqliteutils 4.2 — 发布:sqliteu…
Jay RSS 摘要 simon-willison 2026-08-14 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
在 LLM 中控制推理强度 — LLM 如何学习低、中、高强度的推理模式 使用本地 Coding Agent — 将开源权重模型用于本地 Coding Harness,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Jay RSS 摘要 raschka 2026-08-14 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中间训练(Midtraining)的笔记 — 通过中间训练与持续预训练打造更优的专用 LLM 智能体世界模型(Agentic World Models) — 通过让语言 Agent 对环境建模来构建更优的语言 Agent 智能体强化学习(Agentic RL):框架与最佳实践 — LLM 如何被训练以处理复杂环境中…
flyP RSS 摘要 cameron-wolfe 2026-08-14 10:00
Fireship (YouTube) · RSS 摘要
Meta 的新模型想要"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更糟糕 最安全的比特币存储方式刚刚被攻破…… Anthropic 是否刚刚扼杀了独立开发者……? 历史上最有趣的"黑客事件"……
Jay RSS 摘要 yt-fireship 2026-08-13 10:05
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 重塑规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 11 个关于后续走向的低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-13 10:05
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
Tom RSS 摘要 yt-lex-fridman 2026-08-13 10:05
3Blue1Brown (YouTube) · RSS 摘要
64 块糖方块谜题 到底什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,能产生多少个交点? 测量英语的熵 什么是完美编码?如何证明?
Spark RSS 摘要 yt-3blue1brown 2026-08-13 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析像 ChatGPT 这样的 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时演讲] Large Language Models 简介](
Jay RSS 摘要 yt-karpathy 2026-08-13 10:04
Two Minute Papers (YouTube) · RSS 摘要
OpenAI 的 AI Agent 刚刚越过了某条线 DeepMind 刚刚改变了 AI 理解世界的方式 十亿美元级 AI 竞赛迎来关键转折 又一个 "DeepSeek 时刻" 已经到来 NVIDIA 的 AI 领悟到:仅模仿人类远远不够
flyP RSS 摘要 yt-two-minute-papers 2026-08-13 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-13 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互作用 — 你将选择哪颗星系? Import AI 467:自我维持的 AI 病毒;AI 发展节奏的把握;对 AI 与创造力的困惑 — 我们何时建造月球方舟? Import AI 466:机器人领域的…
Jay RSS 摘要 import-ai 2026-08-13 10:03
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自改进(RSI)概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随模型规模扩大,训练损失 $L$ 可预测地…
Jay RSS 摘要 lilian-weng 2026-08-13 10:02
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 如何理解拓扑关系设立了新基准,并凸显了增强空间推理能力的新机遇…… CAREX:面向临床可用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正在超越报告生成阶段。CAREX 探…
Jay RSS 摘要 msr-blog 2026-08-13 10:02
Interconnects (Nathan Lambert) · RSS 摘要
我写了一本 AI 教科书——AI 还要多久才能写得比我更好? — 关于 AI 写作能力以及 AI 模型如何持续变强的一些思考。 我新出的 posttraining 教科书(即日发布!)中你会学到的 5 个要点 — 历经数年挤出时间,终于把训练开源模型的经验整理成书——我的 posttraining 书完稿了! 来自 h…
flyP RSS 摘要 interconnects 2026-08-13 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这是一份简短的笔记,记录了一些最常见的 pitfa…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著…
Spark RSS 摘要 chip-huyen 2026-08-13 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
我们真的在群组推荐上取得进展了吗?——揭开平局打破的错觉 — 近期群组推荐方法在标准基准上报告了显著提升,但这些增益是否真正反映建模能力的进步仍不明确…… 个性在对话式信息寻求中的作用 — LLM 越来越多地被用于信息寻求场景,用户通过对话查找、对比和评估信息。在此角色下,助手会…… 面向专利匹配的自知识检索增强生成框…
Jay RSS 摘要 cool-papers-ir 2026-08-13 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConVAWG:一个用于针对妇女和女童暴力领域受控合成对话生成的检索增强框架 — 合成对话生成为研究敏感领域中的对话动态提供了一种途径,因为这些领域的真实数据难以获取、发布或标注。潜在的虐… 从可解释性到控制:TrustNLP Workshop 六年的洞察 — 可信赖自然语言处理 Workshop(TrustNLP)自…
Jay RSS 摘要 cool-papers 2026-08-13 10:01