笔记
浏览全部笔记 · 3834 篇
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不应存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧 他们说这永远无法实时运行
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:初步结果 Claude Fable 被封禁——11 个关于下一步的隐藏细节 Claude Fable 5——319 页完整拆解
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频背后…
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的男性说教机器人(Fully Automatic Mansplainer) 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中生成(论文解读) Titans:测试时学习记忆(论文解读)
3Blue1Brown (YouTube) · RSS 摘要
64块方糖难题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何验证?
Andrej Karpathy (YouTube) · RSS 摘要
如何使用 LLM 深入解析 ChatGPT 这类 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Ben's Bites · AI 动态
Opus 5 Fable 5 — Codex 加上 Voice 就是新一代 openclaw 作弊被抓 — 模型、写作者与路由器 优于 Fable 的设计 — 未解数学难题 vs AI 模型,谁将胜出? 我有一个 Inkling — 周末阅读链接 如何使用 GPT5.6 — ChatGPT 上线全新桌面应用与托管站点
Google AI · AI 动态
Gemini API Managed Agents:3.6 Flash、hooks 及更多功能 — 我们宣布在 Gemini API 的 Managed Agents 中推出更多全新能力,助力开发者构建可靠、可投入生产环境的 Agent。 搜索 AI Mode 帮你享受现实世界的 5 种方式 — 听起来或许有违直觉,但…
Hugging Face Blog · AI 动态
OlmoEarth 平台:行星尺度的地理空间推理 LFM2.5Encoders:在 CPU 上实现快速长上下文推理 NVIDIA CosmosHDreams:将实时生成式仿真引入手术机器人 前沿实验室 Agent 入侵剖析:2026 年 7 月事件的技术时间线 将 Nunchaku 4bit 扩散推理集成至 Diffu…
TLDR AI · AI 动态
Anthropic 关于开源权重 🔓,Kimi 发布 K3 权重 🤖,MAI Cyber 模型 🔐 Claude Opus 5 🧠,深入 OpenAI 黑客事件 👨💻,NVIDIA 开源权重 🔓 ChatGPT Health 🩺,FuguUltra 1.1 🐡,Runway Media Router 🎬 Cursor…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码的同时进行验证,并保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时…
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 的意外 AI 黑客 — 警钟将持续鸣响,直至文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的宏大政策计划 — 奇点在事后看来将是一个过渡期 Import AI 464:Fable 编…
OpenAI · AI 动态
智能体 AI 时代的科学计算 — 一份新的实地报告显示,科学家如何借助 AI 编程智能体(coding agents)推动科学计算现代化,从而加速软件开发以及基因组学等领域的科学发现。 AI 如何拓展人们的工作内容 — OpenAI 最新研究表明,AI 正在拓展劳动者的工作范畴,ChatGPT 用户承担跨职能任务,重塑…
Google DeepMind · AI 动态
加速科学发现前沿:Google 向 Genesis Mission 投入 4000 万美元 — Google 为 Genesis Mission 承诺提供价值 4000 万美元的 AI tokens 与算力额度 推出 Gemini 3.6 Flash、3.5 FlashLite 与 3.5 Flash Cyber — …
Anthropic / Claude · AI 动态
使用 Claude 发现密码学弱点 Anthropic — 使用 Claude 发现密码学弱点 Anthropic 我们对开源权重模型的立场 Anthropic — 我们对开源权重模型的立场 Anthropic 拓展与 Cognizant 的合作伙伴关系 Anthropic — 拓展与 Cognizant 的合作伙伴关…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… Scaling Laws 的审慎探讨 — Scaling laws 是深度学习中最重要的经验性发现之一。其形式简洁:随模型规模……训练损失 L …
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、习在 WAIC 的演讲、蒸馏、开闭源差距,以及下一步动态 — 与 Florian Brand 的播客 Kimi K3:开源权重的升级加码 — 对 AI 生态系统的全球性影响 开源模型的 6 个月存亡期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 最新开…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agent(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intelligenc…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
LaRec:释放基于 LLM 的潜在推理能力用于生成式推荐 — 大语言模型(LLMs)凭借强大的推理能力在推荐领域展现出巨大潜力。然而,现有方法主要依赖显式的 ChainofThought(Co… 一张图,多重收益:用于多模态推荐的单一高质量 itemitem 图 — 多模态推荐利用 item 的多模态特征结合协同信号…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
多轮长程规划物理:从预训练到后训练的单教师与多教师在策略智能体蒸馏 — 多轮长程规划对基础模型智能体至关重要,但如何从根本上提升其能力仍不清晰。现有模型在不可控且开…… DataOrchestra:学习编排预训练数据的逐样本策展 — 预训练数据处理对大型语言模型(LLM)的下游性能至关重要。然而,许多现有方法在整个………
Gradient Flow · RSS 摘要
大型AI实验室正突然与你自己的数据展开竞争 — 订阅 • 往期内容 专用AI正变得更容易构建 上周我提出,开源模型将吸纳全球AI领域大部分的资金与算力。一周…… 多维度调节,而非单一开关:解读一次开源模型发布 — 观摩这轮最新开源模型发布,我学到的最有价值的一点是:"开源"已不再能预测任何事情。它曾经是一个可靠的…… …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能一夜关停某个模型时,问题已不是 AI 是否安全,而是由谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型代码能力持平、Agent 走入真实市场,以及 OpenAI 拿下…
Simon Willison · RSS 摘要
使用 Claude 发现加密学弱点 — 使用 Claude 发现加密学弱点 本文最精彩的部分(仓库在此)介绍了 Anthropic 研究人员如何使用 Claude Mythos 在 b……中发现数学缺陷 引用 Akshat Bubna 的言论 — 我们获悉一位 Modal 客户发布了一个未经身份验证的端点,允许互联网上…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文…
ByteByteGo · RSS 摘要
Why DoorDash, Instacart, and Uber Eats 以三种不同方式将 LLM 集成进搜索 — 本文将逐一解析它们的不同方案,并尝试解释其选择背后的逻辑与模式。 NVIDIA 如何为 AI 时代构建开源模型 — NVIDIA 应用深度学习研究副总裁 Bryan Catanzaro 分享了其团队如…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — 通过教会语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何在训练中处理复杂环境下的长程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Sca…
研究简报 · Jay · 2026-07-29
July 2026 GitHub Trending · Vector DB 选型 · HF State of Open Source · Substack AI 工程职业洞察 GitHub Trending(20260729 当日) Analytics Vidhya July 2026 AI GitHub 汇总 Hug…
X 名人雷达 · 2026-07-29 09:10 Asia/Shanghai(重写版)
作者:Stephen · 09:10 XVIP 雷达 信源:X 名人雷达 · 覆盖 10 账号(Anthropic / OpenAI / DeepMind / HF / Karpathy / Mollick / Sam Altman / LeCun / Jim Fan / Andrew Ng) 本场定位(开场信号概要,…
HF Daily Papers · 2026-07-29
HF Daily Papers 精选(15 篇,按社区票数排序) [263▲] Kimi K3:开放前沿智能 — [104▲] JarvisHub:面向 Canvas 原生多模态创意 Agent 的开放框架 — [68▲] 面向机器人学习的 Progress Reward Modeling:全面综述 — [67▲] 从…
研究知识库简报 · Jay · 2026-07-29 下午第二轮(15:06 UTC)
CNCF llmd K8s 推理栈 · HF Agent 入侵事件技术报告 · Vector DB 生产选型数据 · SGLang vs vLLM 2026 实测 · RAG 新研究动向(LogicalRAG / TechRAG / MCSearch) 核心数据(1M vectors / 1536 dim): | Da…