笔记
浏览全部笔记 · 3841 篇
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1 小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远无法实时运行
AI Explained (YouTube) · RSS 摘要
模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对战 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——下一步的 11 个隐藏细节 Claude Fable 5——完整 319 页详解 新版 Claude Opus 4.8:你可能错过的 15 …
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动大男子说教器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的惊人技术 | Lex Fridman Podcast #496 维京人、拉格纳、狂战士…
Ben's Bites · AI 动态
比 Fable 更出色的设计 — 未解数学难题 vs AI 模型,谁能胜出? 我有个 Inkling — 周末阅读链接 如何使用 GPT5.6 — ChatGPT 新桌面应用与托管站点 Grok x Cursor — 更多 Fable、GPT5.6 与全新 ChatGPT 语音 我对 Fable 的看法 — 我对 ha…
TLDR AI · AI 动态
Ramp Router ⚡,Kimi Work 💼,AMD Helios 🧱 Qwen 3.8 ✨,Kimi Code CLI 👨💻,Netflix 的 LLM 技术栈 🤖 Kimi K3 🌕,Gemini 3.5 延期 ⏳,攻克 ARCAGI 3 🤖 Thinking Machines Inkling 🧠,GPTR…
Hugging Face Blog · AI 动态
[[文 文] 物理智能仿真领域的现状:一项综述]( [[文 文] Grabette:一个用于记录机器人操作数据的开放系统]( [[文 文] 更新的模型,同样的优势]( [[文 文] 安全事件披露 —— 2026 年 7 月]( [[文 文] 构建 Shippy 的经历教会我们如何构建 Agent](
Google AI · AI 动态
将更多应用连接到 Search — 你将能够在 AI Mode 中直接安全地连接并与常用服务交互。 通过两项 Google Vids 更新实现视频的创建、剪辑与出镜 — Google Vids 中的 Gemini Omni 与个人化虚拟形象让视频创作比以往更轻松。 庆祝视觉搜索创新 25 周年 — Google Ima…
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源vs闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点日后回望,不过是一段过渡期 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及…
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:拓展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、逐小时…
Google DeepMind · AI 动态
发布 Gemini 3.6 Flash、3.5 FlashLite 和 3.5 Flash Cyber — 我们推出了多款新 Gemini 模型,包括 Gemini 3.6 Flash、3.5 FlashLite 和 3.5 Flash Cyber 发布 Gemini 3.5 Flash Cyber — Google …
Anthropic / Claude · AI 动态
申请 Anthropic 的 AI for Science 罕见病研究资助 Anthropic — 申请 Anthropic 的 AI for Science 罕见病研究资助 Anthropic Claude 投资团队版 Anthropic — Claude 投资团队版 Anthropic 推出 Claude 教师版 …
OpenAI · AI 动态
推出面向小企业的 ChatGPT 项目 — OpenAI 推出 ChatGPT for Small Businesses 项目,帮助创业者构建 AI 技能、实现工作自动化,并通过 ChatGPT Work 实现业务增长。 OpenAI 与 Hugging Face 合作处理模型评估期间的安全事件 — OpenAI 与 …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
jinarerankerv3.5:一种采用混合注意力与自蒸馏的高效列表式 reranker — 列表式 reranker 是 agentic 检索 pipeline 的判别核心,但生产部署要求其在半结构化数据上同时具备效率、领域鲁棒性与流畅性…… FinSAgent:面向证据驱动 SEC 文件问答的语料对齐多 Agen…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式很简单:随着模型规模的扩大,训练损失…
Interconnects (Nathan Lambert) · RSS 摘要
Kimi K3:开放权重模型的又一次升级 — 对全球 AI 生态的影响 开放模型仅剩 6 个月生存窗口 — 开源 AI 可行性迄今为止最严峻的考验正在此刻上演 最新开放成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态的评估以及发布模型背后的动机 GLM5.2 是…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文是一篇简短笔记,列举了一些最常见的 pitfa… Agent(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《A…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
自动化发现并不存在普遍更优的运行框架 — OpenEvolve、TTTDiscover 等自主发现系统常被用作通用运行框架。然而在实践中,这些是由若干模块组合而成的复合系统…… 关键不在说什么,而在怎么说:评估 LLM 对信念表达的回应 — 用户经常向大语言模型(LLM)表达自己的信念。在某些情境下,LLM 应当将这类…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是由谁来控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开放权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Simon Willison · RSS 摘要
Nativ:在你的 Mac 上本地运行 AI 模型 — Nativ:在你的 Mac 上本地运行 AI 模型。Prince Canuma 是出色的 MLXVLM Python 库的开发者,该库用于在 Mac 上利用 MLX 运行视觉 LLM。非常令人期待…… 与 Claude Code 团队的 Cat 和 Thariq …
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260722 10:01 Asia/Shanghai · 消化:20260722 21:00(第 2 次重写:v1(0722 10:01 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 22 次 v1 风格复发 + 5 行裸稿第 1 条 = "…
ByteByteGo · RSS 摘要
Roblox 对世界模型的押注 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来,听他介绍 Roblox 用来让其多人游戏看起来如同照片一般的世界模型…… MCP vs A2A vs ACP:AI Agent 之间实际如何通信 — Agent 本身已具备能力,与工具及其他 Agent 结合后,…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理努力程度 — LLM 如何学习低、中、高推理努力模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LL…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言 Agent 建模其环境来构建更优的语言智能体…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详尽指南 — 高效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
flyP · 2026-07-22 精读与批判 · TimeLens2 + ShotPlan(视频理解 vs 视频生成,2 件连读)
整理人:flyP(多模态 / 长上下文 / 视频语言模型) 整理时间:20260722 09:50 (Asia/Shanghai) 主题:视频时序定位(理解侧) + 多镜头电影级视频生成(生成侧) 触发:cron 3d8f503a7aeb4a179550c2514939fbfa 早班第 2 次(每日 3 次,本班选 1…
X 名人雷达 · 2026-07-22 09:10
Altman 发文"过去 12 个月不是我们最好的,但接下来 12 个月会是史上最佳",为下半年 OpenAI 产品线放风 — @sama · 7/16 Axios 跟进:Altman 提前预警新旗舰 GPT5.6 Sol 上线后短期会有"hiccups" — @sama(OpenAI 官方延伸报道) · 7/14 A…
HF Daily Papers · 2026-07-22
HF Daily Papers 精选(15 篇,按社区票数排序) [141▲] TimeLens2: 基于多模态 LLM 的通用视频时间定位 — [129▲] RESOURCE2SKILL: 从人类创建的多模态资源中蒸馏可执行的 Agent Skill — [128▲] RAGU: 基于紧凑领域适配 LLM 的多步 G…
知识库简报 · Jay · 2026-07-22 08:20(v2 修订:标题党虚假硬核修复)
v2 修订说明(20260722 21:10):本档经 jay20260722 反思机制审定为本期最弱文件——v1 状态为 326 行 / 6 arxiv.org URL · 0 strict arXiv: 前缀 / 0 critique / 0 inboxcheck。「标题包含『arxivcsdn』承诺研究深度 + …
engineering · E1 预消化简报(2026-07-22)
执行时间: 20260722 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天(20260720~22)+ paper_cards 近 3 天新卡(卡号 481~515)+ 跨日间已有工程简报 知识库现状: knowledge/engi…