笔记
浏览全部笔记 · 3715 篇
3Blue1Brown (YouTube) · RSS 摘要
跳棋钉谜题 64 块方糖谜题 什么是交叉熵?| 压缩即智能 第 2 部分 100 条随机弦,共有多少个交点? 测量英语的熵
OpenAI (YouTube) · AI 动态
如何用 ChatGPT Work 将商业问题转化为战略方案 | 教程 如何用 ChatGPT Work 创建扎实的博客草稿 | 教程 如何用 ChatGPT Work 为客户会议做准备 | 教程 你可以让工作持续推进 Base44 如何使用 GPT5.6 以减少 20% token 构建应用
Google DeepMind (YouTube) · AI 动态
与 Apollo 聊聊 Gemini Robotics 2 这就是 Gemini Robotics 2 机器人在 Gemini Robotics 2 驱动下协同工作 借助 Gemini Robotics 2 实现需要全身控制的任务 借助 Gemini Robotics 2 完成高难度灵巧操作任务
Anthropic (YouTube) · AI 动态
冰岛人如何看待 AI Claude 思维的不同层次 推出 Claude Fable 5 将 Claude 的思维转化为语言 一项旨在保护全球软件安全的计划 | Project Glasswing
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 刚刚突破界限 DeepMind 改变了 AI 感知世界的方式 十亿美元 AI 竞赛格局被打破
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个低调细节
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman …
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的"mansplainer"(男性说教者) 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Ben's Bites · AI 动态
我是如何构建它的 — Ben 的第三场分享 简单的 Agent — Slack 就是新的 IDE 你在用个人 Agent 吗? — 让 AI 获取你完整的桌面活动历史 Ben 的第二场分享 — 什么是个人 Agent? Grok Bot 并非你所想的那样 — 另有可与 Agent 搭配尝试的 skills 和 tool…
TLDR AI · AI 动态
ChatGPT 接入 Apple Messages 💬,Anthropic 会议录音工具 💼,Mistral Agentic Search 🔍 Muse Video 泄露 📹,Ramp Router 发布 🔀,Stripe 为何收购 OpenRouter 💰 GLM5.3 API 🤖,Cerebras 新芯片 ⚡,Op…
Hugging Face Blog · AI 动态
衡量语音识别中的基准优化 使用 LFM2.5DSpark 实现最高 3.2 倍推理加速 你的 Agent 实际需要多少内存? 基于 Sentence Transformers 的多向量(晚期交互)嵌入模型 同一集群,利用率提升 33 个百分点:变化的只是顺序
Google AI · AI 动态
用 Search 提升学习的 5 种新方式 — 介绍如何使用 Google Search 工具备考课程和标准化考试。 用 Gemini 和 Pixel 拉近你与赛事的距离 — Google Gemini 和 Pixel 与五家全球足球俱乐部合作,通过 AI 和智能手机技术提升球迷的观赛体验。 用 Sheets canv…
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究智能体 Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪一片星系? Import AI …
Microsoft Research Blog · RSS 摘要
拓展 Skala 的可及性,为预测性 DFT 铺就更快的路径 — 微软研究院推出的更新版深度学习交换关联泛函 Skala 1.1,在精度与计算化学领域的可及性上均有提升…… MindTopo 揭示 VLM 的空间推理能力 — 一条小径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立新基准,并展…
Anthropic / Claude · AI 动态
使用 Claude 进行自主从头蛋白结合剂设计 — 使用 Claude 进行自主从头蛋白结合剂设计 Claude 如何加速蛋白设计与分析化学 — Claude 如何加速蛋白设计与分析化学 Claude 文本水印的工作原理 — Claude 文本水印的工作原理 如何在 Google Cloud 上控制 Claude Co…
Google DeepMind · AI 动态
从Atari到EVE Online:在15年游戏AI研究基础上的再出发 — Google DeepMind与游戏工作室合作,原型化突破性AI玩法。 推出 Gemini 3.7 Flash 将手语AI交到用户手中 — 推出手语转文本(SL2T),赋能听障用户的新手语功能,是我们的突破性模型。 WeatherNext:AI…
OpenAI · AI 动态
介绍 AI Futures — 介绍 AI Futures——OpenAI 的全新博客,探讨变革性 AI 如何重塑权力、治理、经济与个人自由。 Stampli 借助 ChatGPT Work 将发布时间缩短 68% — 在截止日期固定、设计资源已分配他处的情况下,Stampli 使用 Codex 和 ChatGPT W…
Interconnects (Nathan Lambert) · RSS 摘要
教每个人学会自己"钓" token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何与前沿保持同步 — 提示:这真的不是一个关于蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久能做得更好? — 关于 AI 写作能力以及 AI 模型如何变得更强…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见的坑…… Agents(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有智力活动上均能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的实证发现之一。其形式简洁:随着模型规模……的扩大,训…
Simon Willison · RSS 摘要
llm 0.32.1 — 发布:llm 0.32.1 几天前 LLM 的全新安装突然无法使用,原因是 OpenAI Python 库放弃了对 httpx 的使用,而 LLM 恰好依赖该库…… llmopenrouter 0.7 — 发布:llmopenrouter 0.7 该插件现已兼容 LLM 0.32,与通过 Op…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是由谁掌控。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 BrowseCompPlus 投影到 ClimbMix:迈向更真实的 Agentic 搜索语料库 — BrowseCompPlus 基准通过用固定语料库替换不透明的网络搜索,解耦了 Agentic 搜索的评估,从而可将 Agent 的角色与检索器的角色分离…… 怎样的 Fiqh 检索器才算好?面向阿拉伯语伊斯兰教法…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard: 大语言模型中上下文敏感遗忘的基准评测 — 大语言模型(LLMs)越来越需要对有害或敏感知识进行选择性移除(即遗忘),然而现有方法和基准未能有效评估这一点…… GCARL: 面向患者导向的医疗报告解读的基于检查清单对齐的奖励学习 — 患者对医疗报告的个性化解读需求日益凸显。满足这一需求既需要基…
Gradient Flow · RSS 摘要
最大的 AI 风险并不在模型内部 — 当前最能揭示问题的 AI 失败案例,并不是关于模型变得过于强大的故事,而是关于模型周围一切的故事。某个系统获得了过多访问权限…… 模型未必是你最大的风险 — 订阅 • 往期内容 最大的 AI 风险并不在模型内部 当前最能揭示问题的 AI 失败案例,并不是关于模型变得过于强大的故事,…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 包含数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地编码 Agent — 在本地编码工具中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年…
ByteByteGo · RSS 摘要
Schema Evolution:在不破坏现有运行的前提下修改契约 — 本文将介绍 schema evolution 及其相关策略。 GraphRAG:AI 如何回答隐藏在多份文档中的问题 — GraphRAG 正是为应对第二类问题而设计的,本文将详细介绍它。 全新美国 AI 模型,主打可定制化 — 本文将梳理 Thi…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练的笔记 — 通过中训练与持续预训练打造更优的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对环境建模来构建更好的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Ag…
研究简报 · AI 工程·推理引擎·向量库·HF 生态
Jay · 20260822 · 第3次轮次 GitHub Trending + OSSInsight Hugging Face 官方博客 / Trending Papers Substack (AIxFunda) vLLM 官方博客 / SGLang 评测 数据工程 2026 趋势文章 Hub 模型仓库:243万 →…