Notes

笔记

浏览全部笔记 · 1033 篇

Yannic Kilcher (YouTube) · RSS 摘要
我造了一个全自动 mansplainer(爹味说教器) 传统圣诞节直播 传统节日直播 TiDAR:Think in Diffusion, Talk in Autoregression(论文解读) Titans:Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-11 10:05
3Blue1Brown (YouTube) · RSS 摘要
64块糖方块谜题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的� 什么是完美编码?你如何知道?
Spark RSS 摘要 yt-3blue1brown 2026-08-11 10:05
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态建筑? Import AI 466:机器人领域的苦…
Jay RSS 摘要 import-ai 2026-08-11 10:03
Microsoft Research Blog · RSS 摘要
Orchard:一个面向可扩展 agentic AI 的开源框架 — Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向计算机使用 agent 的深度、持续演化环境 — 计算机使用 AI agent 在邮件和…
Jay RSS 摘要 msr-blog 2026-08-11 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是难免的。这是一篇简要笔记,列举了一些最常见陷阱的示例…… Agents — 许多人认为 Intelligent Agents 是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作 Arti…
Spark RSS 摘要 chip-huyen 2026-08-11 10:03
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进 (RSI) 的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规…
Jay RSS 摘要 lilian-weng 2026-08-11 10:02
Interconnects (Nathan Lambert) · RSS 摘要
我的新 posttraining 教科书中你将学到的 5 个要点(即日上线!) — 经过漫长数年的积累,我终于把训练开放模型的实战经验整理成书,posttraining 书完稿了! 实战踩坑经验总结 — 对模型对齐、安全的决定因素以及未来方向的思考 全新发布:Artifacts Hub 与 Adoption Dashb…
flyP RSS 摘要 interconnects 2026-08-11 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 重启、中国 openweights 模型实现编程能力对等、Agent 走入真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-08-11 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
CreativeInstruct: 可扩展地教导 LLM 平衡质量、创造力与多样性 — 后训练提升了 LLM 的能力,但通常会降低其输出的多样性和创造力,对那些明确依赖…… CoinRAG: 长上下文 RAG 的上下文化信息片段 KV 缓存复用 — 近期 RAG 优化研究利用 chunk 级 KV 缓存复用以避免处理长…
Jay RSS 摘要 cool-papers 2026-08-11 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
无需固定 TopL 截断的精确自适应混合检索 — 现代检索增强生成(RAG)系统通常将稠密检索器与稀疏检索器的固定 Top$L$ 结果进行融合,将后续贡献视为零。因此该截断点... 机器视角盲区:基于完整市场普查的 AI 餐饮酒吧推荐审计 — AI 助手正成为本地发现的主要入口,但几乎无人知晓它们会推荐哪些场所——尤其…
Jay RSS 摘要 cool-papers-ir 2026-08-11 10:01
Gradient Flow · RSS 摘要
为什么数据中心成为 AI 反对浪潮的焦点 — AI 不再仅作为软件被评判。当基础设施建设以大规模工业设施、新增输电线路、持续电力需求以及可能带来的压力等形式落地时…… 语言模型之后是什么 — 我经常看到科学发现被框定为足够雄心勃勃的预测或数据压缩问题。Tom Zahavy 最近的一篇立场论文通过区分……来挑战这一观点 …
Spark RSS 摘要 gradient-flow 2026-08-11 10:01
Simon Willison · RSS 摘要
介绍 Muse Glimmer — 介绍 Muse Glimmer Meta 重返开源权重赛道!Muse Glimmer 是一款全新的 30B 模型,采用干净的 Apache 2.0 许可证(相比 Llama 系列那些糟糕的许可证是一次升级…… 引用 OpenClaw — 该 API 在取消他人预订时没有任何授权校验……
Jay RSS 摘要 simon-willison 2026-08-11 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding 框架中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇编 …
Jay RSS 摘要 raschka 2026-08-11 10:00
ByteByteGo · RSS 摘要
如何对抗标题党:Meta、LinkedIn 与 YouTube 案例研究 — 社交媒体平台需要做什么才能停止奖励标题党内容? 读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始逐步讲解这一思路。 为什么 LLM 的内存开销会变高以及如何解决 — 本…
Jay RSS 摘要 bytebytego 2026-08-11 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中训练笔记 — 通过中训练与持续预训练构建更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 建模环境来构建更优的语言 Agent Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长时域任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模…
flyP RSS 摘要 cameron-wolfe 2026-08-11 10:00
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚扼杀了独立开发者吗……? 历史上最有趣的"黑客"行为…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-10 10:04
AI Explained (YouTube) · RSS 摘要
AI 开始有点失控了 GPT6 失控?HuggingFace 事件还原,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果出炉 Claude Fable 被封——后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-10 10:04
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与万物理论 — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频…
Tom RSS 摘要 yt-lex-fridman 2026-08-10 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入解析 ChatGPT 这类 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1 小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-10 10:03
Two Minute Papers (YouTube) · RSS 摘要
DeepMind刚刚改变了AI看世界的方式 十亿美元AI竞赛格局被打破 又一个DeepSeek时刻已经到来 NVIDIA的AI领悟到:单纯模仿人类远远不够 Kimi K3刚刚颠覆了AI的经济学
flyP RSS 摘要 yt-two-minute-papers 2026-08-10 10:03
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向计算机使用 Agent 的深度、持续演进环境 — 计算机使用 AI Agent 在邮件、客服等…
Jay RSS 摘要 msr-blog 2026-08-10 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement(面向自我改进的 Harness 工程) — 递归自我改进(RSI)概念可追溯至 I. J. Good(1965),其将"超级智能机器"定义为能在所有智力活动上超越人类的系统…… Scaling Laws,谨慎看待 — Scaling law…
Jay RSS 摘要 lilian-weng 2026-08-10 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;控制 AI 发展节奏;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务,以及 OpenAI 意外的 AI 黑客 — 警告信号将持续下去,直到文明觉醒 Import AI …
Jay RSS 摘要 import-ai 2026-08-10 10:02
Interconnects (Nathan Lambert) · RSS 摘要
从黑客攻击中汲取的教训 — 关于模型对齐、安全的决定因素以及未来出路的随想 推出我们的 Artifacts Hub 与 Adoption Dashboard — 扩展我们对开放生态的策展与度量 最新开放 artifacts(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了位于帕累托前沿…
flyP RSS 摘要 interconnects 2026-08-10 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于基于 foundation models 构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 智能体(intelligent agents)被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norv…
Spark RSS 摘要 chip-huyen 2026-08-10 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2: 取代级联的单模型 基于 Rollout 蒸馏的生成排序推荐器 — 工业推荐系统通常部署为多阶段级联,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联… 个性化的模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模态加权已部署在十亿用户规模上,…
Jay RSS 摘要 cool-papers-ir 2026-08-10 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越依赖外部信号来给出答案,而单一误导性信号就可能将正确答案变成错误。最直接的应对方案是训练模型抵抗此类干扰…… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外操作的 Agent;对于具备代码能力的模型,程序化工具调用通过用代码替代僵化的 JSON…
Jay RSS 摘要 cool-papers 2026-08-10 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国 openweights 模型在代码能力上实现对等、…
Jay RSS 摘要 nathan-benaich 2026-08-10 10:01
Gradient Flow · RSS 摘要
语言模型之后是什么 — 我一直看到科学发现被框定为足够宏大的预测或数据压缩问题。Tom Zahavy 的一篇最新立场论文通过区分离… 通过评估并不意味着你就是安全的 — 评估是关于将 AI 投入生产的每个严肃讨论的一部分。团队定义基准、设定阈值,并越来越多地开展红队测试以观察系统在… Workday、OpenAI 和一…
Spark RSS 摘要 gradient-flow 2026-08-10 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-10 10:00