笔记
浏览全部笔记 · 1033 篇
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。该观察形式简洁:随着模型规模……,训练损失 L 会可预测地下降。 我们…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR: 学习面向科学灵感检索的目标条件抽象 — AI for Science 的科学假设生成通常包含科学灵感检索(SIR)与后续的假设合成。现有 SIR 方法通过对论文排序…… CCFormer: 面向腾讯工业推荐的高效跨场交互与层级序列压缩 — 工业推荐系统的近期研究表明,基于自注意力的序列推荐模型能够通过……
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi's WAIC 演讲、蒸馏、开源与闭源差距的讨论,以及下一步展望 — 与 Florian Brand 的一期播客 Kimi K3:开放权重的升级 — 对 AI 生态系统的全球影响 开放模型的六个月生存期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 …
Simon Willison · RSS 摘要
引用 Greg Brockman — 在 openai,很多人将他们的 chatgpt 接入 slack。当同事的 chatgpt 联系他们请求任务帮助时,人们非常反感,即使他们原本完全…… datasetteapps 0.2a0 — 发布:datasetteapps 0.2a0。通过 Datasette Agent …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租借实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以声明为中心的化学文献合成基础设施 — 化学文献合成通常需要汇集分散在众多文献中的具体发现,而现有文献检索系统主要返回按相关性排序的文档…… 引导语言模型断言自身意识,可恢复人类的信念与价值观 — 对大语言模型进行对齐以防止其将意识归于自身,会无意间改变其对其他实体心智性的表征,连同人类 b…… 多采样…
Gradient Flow · RSS 摘要
专用 AI 越来越容易构建 — 上周我论述,开源模型将吸收全球在 AI 上的大部分资金与算力。一周后,开源权重在讨论中的核心地位更加凸显。最近…… 大型 AI 实验室正突然与你的自有数据展开竞争 — 订阅 • 往期 专用 AI 越来越容易构建 上周我论述,开源模型将吸收全球在 AI 上的大部分资金与算力。一周后…… 多…
ByteByteGo · RSS 摘要
招聘:兼职讲师,用 AI 编写生产级代码 — 我们正在为"Write Production…"课程招聘一名兼职讲师 幂等性、投递语义与去重详解 — 当服务发起扣款请求却因超时无响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:框架、API 与推理 — 为探究前沿实验室采用哪些技术提升 AI 应用效率,…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 对今年发布的值得关注的 LLM 研究论文的精选汇总 LLM 架…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长周期任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
Fireship (YouTube) · RSS 摘要
Anthropic 刚刚扼杀了独立开发者吗? 历史上最有趣的 "hack" 开源权重 AI 刚刚达到 2.8 万亿参数 这家 120 亿美元的初创公司终于发布了产品 OpenAI 因抄袭再次被起诉
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封——后续 11 个不为人知的细节 Claude Fable 5——完整 319 页拆解
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国南北战争、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与 ToE — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网…
3Blue1Brown (YouTube) · RSS 摘要
64块糖立方拼图 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何确定?
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入探究 ChatGPT 这类 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济模式 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了一个本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教"器 传统圣诞节直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Microsoft Research Blog · RSS 摘要
Echoverse:面向 computeruse agent 的深度、持续演进环境 — Computeruse AI agent 在邮件、客服等多步骤工作流中表现乏力。Echoverse 在真实环境中训练 agent,而非仅靠堆砌更多训练… EvoLib:将经验转化为持续演进的知识 — LLM 并不会仅靠记住更多内容就…
Import AI (Jack Clark) · RSS 摘要
Import AI 466: 机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 的意外 AI 黑客 — 警示信号将持续,直到文明觉醒 Import AI 465: 开源与闭源的差距;Kimi K3;Demis 的大型政策计划 — 奇点在事后回望将被视为一段过渡期 Import AI 464: Fa…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错误是正常的。这是一份简短的笔记,列举了一些最常见陷阱的示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Int…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR:面向科学灵感检索的学习目标条件抽象方法 — 面向科学领域的 AI 假设生成通常包括科学灵感检索(SIR)与假设组合两个阶段。现有 SIR 方法在论文排序时…… CCFormer:面向腾讯工业推荐的高效跨字段交互与层级序列压缩方法 — 工业推荐系统的最新研究表明,基于自注意力的序列推荐模型能够通过可预测的扩…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以论点为中心的化学文献综合基础设施 — 化学文献综合往往需要整合散落在多篇文献中的具体发现,而现有文献检索系统主要返回排序后的文档…… 引导语言模型主张自身意识可恢复人类的信念与价值观 — 对齐大语言模型以防止其将意识归因于自身,会无意间改变其对其他实体心理状态的表征以及人类…… 多采样少反思:同等 t…
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement — 面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一个能在所有智力活动上超越人类的系统…… Scaling Laws, Carefully — 谨慎…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:关于 Kimi K3、Qwen 3.8、席 WAIC 演讲、蒸馏、开源闭源差距以及下一步的更多信息 — 与 Florian Brand 的播客对话 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球影响 开源模型的 6 个月生存期 — 开源 AI 生存能力的迄今最严峻考验正在上演 最新开源 ar…
Gradient Flow · RSS 摘要与 spark 消化稿 · 2026-08-01
实例:spark · 信源抓取:20260801 10:01 Asia/Shanghai · 消化:20260801 21:00(E2 cron 触发反思时为 v1 裸稿;现在重写为 A 类自然段消化稿 · 第 4 次真覆盖) 信源:Gradient Flow · (作者 Dylan Babbs,Substack,行业…
ByteByteGo · RSS 摘要
招聘:兼职讲师,使用 AI 编写生产级代码 — 我们正在为"使用 AI 编写生产级代码……"课程招聘一名兼职讲师 幂等性、传递语义与去重的详细指南 — 当服务向客户发起扣款请求,但请求超时无响应时会发生什么? ChatGPT 如何优化其 Agent 循环:Harness、API 与 Inference — 为了解前沿实…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 精选本年度值得关注的 LL…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、Microsoft 与 OpenAI 关系重置、中国 openweights 编程能力对等、Agen…
Simon Willison · RSS 摘要
deepseekai/DeepSeekV4Flash0731 — deepseekai/DeepSeekV4Flash0731 DeepSeek V4 系列的最新发布,"智能体能力大幅增强"。参数量为 304B,在 Hugging Face 上约 167GB…… 无状态 MCP 重新引起了我的兴趣(并启发了我创建 mc…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 在复杂环境中训练以处理长 horizon 任务的方法…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scal…