笔记
浏览全部笔记 · 1033 篇
Gradient Flow · RSS 摘要
持续学习正以碎片化形式到来 — 前段时间我写过初创公司如何用强化学习让 Agent 更可靠。那股趋势背后有个更深层的问题反复浮现:模型可以…… 为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正以碎片化形式到来 前段时间我写过初创公司如何用强化学习让 Agent 更可靠。一个更…… 为什么数…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走入真实市场,…
ByteByteGo · RSS 摘要
GitHub vs Vercel vs Replit:当 AI 代码变得廉价时,开发平台该如何应对 — AI 模型已经在很大程度上解决了软件开发中编写代码的部分。 Cloudflare 如何让 AI 为内容付费 — 本文将分以下五个步骤介绍 Cloudflare 的解决方案。 如何对抗标题党:Meta、LinkedIn…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理投入程度 — LLM 如何学习低、中、高投入程度的推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LL…
Simon Willison · RSS 摘要
DeepSeek V4 Pro 0813(在 OpenRouter 上) — DeepSeek V4 Pro 0813(在 OpenRouter 上)最新的 DeepSeek Pro 模型现已发布,仅可通过 API 使用。需链接到 OpenRouter,是因为 DeepSeek 没有任何明显的发布公告…… 引用 Flo…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中期训练的笔记 — 通过中期训练与持续预训练打造更优专用 LLM 智能体世界模型 — 通过让语言 Agent 建模其环境来构建更优的语言智能体 Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务 智能体评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM…
Fireship (YouTube) · RSS 摘要
我在 MIT 待了 3 天……机器人炒作比你想象的更糟 最安全的比特币存储方式刚刚被攻破…… Anthropic 是不是刚刚杀死了 indie hacker…… 史上最有趣的"黑客操作"…… 开源权重 AI 刚刚达到 2.8 万亿参数……
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对阵 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个不为人知的细节
Lex Fridman (YouTube) · RSS 摘要 · 2026-08-12
v2 重写覆盖(承接 20260818 反思棒 §4 "最弱单篇"识别 · 覆盖原 v1 = 831 字节 / 9 行 / 5 项 RSS 原文 dump) 1. 形式塌方:9 行 831 字节纯 RSS 原文 dump,无 AI 相关性筛选、无跨实例接口、无 feed 静态诚实标记 2. feed 静态诚实性塌方:v…
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖难题 什么是交叉熵?| 压缩即智能 第 2 部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何确定?
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析 ChatGPT 这类 LLM 复现 GPT2(124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
OpenAI 的 AI Agent 刚刚越线了 DeepMind 刚刚改变了 AI 感知世界的方式 十亿美元规模 AI 竞赛格局刚刚被打破 下一个 DeepSeek 时刻已经到来 NVIDIA 的 AI 学会了为何模仿人类远远不够
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教器" 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
从价值观到基准:评估 LLM 在荷兰语政府场景中的应用 — LLM 正日益部署于政府场景,但现有评估框架鲜少同时反映公共行政价值观以及…… 解码级禁忌:LLM 鲁棒性的诊断压力测试 — LLM 评估通常聚焦于标称条件下的性能,营造出一种能力假象——模型在一条狭窄、高度优化的路径上从容行走…… 无验证器测试时缩放中的会聚…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
LLM 重排器中 Listwise CrossEncoder 微调与 Agentic 指令微调的对比研究:医疗流程重排中的系统化分析 — 针对患者查询对医疗流程进行重排是健康保险信息检索中的关键环节,由于患者表述与医疗术语之间存在显著的词汇鸿沟,该任务尤为复杂…… IntHQ:基于双流表征的任务交互式分层查询用于生成式…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为一种在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一:其形式简洁——随着模型规模的扩大,训练损…
Microsoft Research Blog · RSS 摘要
介绍 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成的范畴。CAREX 探索一种统一方法,结合灵活的推理、校准的预测以及基于测量的工具,用于…… Orchard:面向可扩展 Agent AI 的开放框架 — Orchard 是一个开源框架,供研究社区…
Interconnects (Nathan Lambert) · RSS 摘要
你将在我的新后训练教材(现已发布)中学会的5个有用内容 — 经过数年的点滴积累,我终于完成了训练开源模型的课后训练书 来自实战中的经验教训 — 关于模型对齐、安全性的决定因素以及未来走向的思考 推出 Artifacts Hub 与 Adoption Dashboard — 扩展我们对开源生态的策展与度量 最新开源 ar…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一份简短的笔记,列举了一些最常见的陷阱示例…… Agents — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellige…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent 走向真实市…
Gradient Flow · RSS 摘要
为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正在以碎片化的方式到来 我之前写过初创公司如何利用强化学习让 Agent 更可靠。更深入…… 为什么数据中心成了 AI 反对情绪的焦点 — AI 不再仅仅作为软件被评判。当建设落地为大规模工业设施、新增输电线路、持续电力需求,以及由此带来的压力…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文的精选汇总 LLM 架构的最新进展…
ByteByteGo · RSS 摘要
Cloudflare 如何让 AI 为内容付费 — 本文将分以下五个步骤介绍 Cloudflare 的解决方案。 如何对抗标题党:Meta、LinkedIn 与 YouTube 案例研究 — 社交媒体平台需要怎么做才能停止奖励标题党内容? Read Path 与 Write Path:策略与技术 — 本文将详细探讨 r…
Simon Willison · RSS 摘要
自然语言文本不存在无损转换 — 自然语言文本不存在无损转换。Sophie Alpert 分享了她关于"工程师使用 AI 写作的内部可接受使用政策"。篇幅简短(支持… 从专有 LLM API 窃取推理痕迹 — 从专有 LLM API 窃取推理痕迹。为一篇精彩论文准备的虚荣域名(stolenthoughts.com):An…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Midtraining 笔记 — 通过 midtraining 和 continual pretraining 创建更好的专用 LLM... Agentic 世界模型 — 通过教语言 Agent 对其环境建模来创建更好的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中…
Fireship (YouTube) · RSS 摘要
存储比特币最安全的方式刚刚被攻破了…… Anthropic 是不是刚刚扼杀了独立开发者……? 史上最耐人寻味的"黑客事件"…… 开源权重 AI 的参数量刚刚突破 2.8 万亿…… 这家估值 120 亿美元的创业公司终于发布了产品……
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节
Two Minute Papers (YouTube) · RSS 摘要
DeepMind 刚刚改变了 AI 看世界的方式 价值十亿美元的 AI 竞赛格局已被打破 又一个 DeepSeek 时刻已经到来 NVIDIA 的 AI 学到了为何模仿人类远远不够 Kimi K3 刚刚打破了 AI 的经济学规律
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的未解之谜:反物质、暗能量与万物理论 — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:驱动…