笔记
浏览全部笔记 · 3820 篇
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗……? 历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Two Minute Papers (YouTube) · RSS 摘要
DeepMind刚刚改变了AI看世界的方式 价值十亿美元的AI竞赛格局已被打破 下一个DeepSeek时刻已经到来 NVIDIA的AI领悟到:模仿人类远远不够 Kimi K3刚刚打破了AI的经济逻辑
AI Explained (YouTube) · RSS 摘要
AI 开始有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对战 GPT 5.6 Sol:早期结果 Claude Fable 被封锁——关于下一步的 11 个低调细节
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万物理论 — Don Lincoln | Lex Fridman Podcast #4…
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
3Blue1Brown (YouTube) · RSS 摘要
64 颗方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,会有多少个交点? 测量英语的熵 什么是完美编码?你如何得知?
Anthropic (YouTube) · AI 动态
Claude 思考的不同层次 介绍 Claude Fable 5 将 Claude 的思维翻译成语言 守护全球软件安全的倡议 | Project Glasswing 当 AI 表现出情感时
Google DeepMind (YouTube) · AI 动态
与 Apollo 畅谈 Gemini Robotics 2 🤖 这就是 Gemini Robotics 2 🤖 Gemini Robotics 2 让机器人协同作业 Gemini Robotics 2 的全身控制任务 Gemini Robotics 2 挑战高难度灵巧操作任务
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;调控 AI 进展节奏;对 AI 与创造力的混淆 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警示将持续,直到文明觉醒 Import AI 46…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入了解像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] Large Language Models 介绍](
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开放框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,仍能支持小模型实现强大性能…… Echoverse:面向计算机使用 Agent 的深度且持续演进的环境 — 计算机使用型 AI Agent 在邮…
Anthropic / Claude · AI 动态
改进 Fable 5 的生物安全防护 Anthropic — 改进 Fable 5 的生物安全防护 Anthropic 调查我们在网络安全评估中的三个真实事件 Anthropic — 调查我们在网络安全评估中的三个真实事件 Anthropic 使用 Claude 发现密码学漏洞 Anthropic — 使用 Claud…
Ben's Bites · AI 动态
Ben 的分享 — 我的 agent 活动现场笔记 我在用一款新的 agent 应用 — Google 要出事了吗? 我的 agent 了解我什么 — 便宜 80% 的 GPT ChatGPT 用户突破 10 亿 — 折腾 tldraw 真的很有趣 Opus 5 Fable 5 — Codex + Voice 就是新一…
TLDR AI · AI 动态
GPT5.6 Luna 默认模式 🌙, Agent Plugins 🔌, AMD 收购 Taalas 🧩 Google DeepMind 重组 🧠, Meta Muse Code 💻, Anthropic 芯片团队 🧩 Google LLM router ➡️, Cloudflare Wallets 💳, Anthro…
Google DeepMind · AI 动态
WeatherNext:AI 模型在气旋预测方面取得突破性进展 Gemini Robotics ER 2:以视频理解、任务编排和多机器人协作赋能机器人 — Gemini Robotics ER 2 帮助机器人进行推理、协作并解决现实任务,在视频理解、工具编排和多机器人协作方面实现跨越式提升 在 Google Flow …
Google AI · AI 动态
我们在2026年7月公布的最新 AI 资讯 — 以下是 Google 在2026年7月的最新 AI 更新 走进我们35.3万人参与的 vibe coding 课程 — Kaggle 与 Google 联合推出的 AI Agents Intensive 课程以免费形式汇聚学习者,共同构建并部署 AI 的下一个前沿。 Ge…
OpenAI · AI 动态
应对关键网络能力的新前沿 — OpenAI 分享 Astra 的初步网络安全评估,以及我们为加强安全防护与安全控制所采取的措施。 HSP GRUPPE 如何为税务咨询构建 AI 能力 — 了解 HSP GRUPPE 如何使用 ChatGPT Enterprise 提升生产力、改善工作质量,并为税务咨询与客户服务创造更大…
Hugging Face Blog · AI 动态
TutorMoments:AI 辅导者知道何时介入、何时退让吗? Baseten 上线 Hugging Face 推理服务 🔥 借助 LFM2.52.6B 在任意环境部署本地 Agent GPU 管理:闲置 GPU 正成为新的"停场飞机" NVIDIA CosmosHDreams:将实时生成式仿真引入手术机器人
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越多地依据外部信号来调整其回答,而单一误导性信号就可能把正确答案变为错误。显而易见的解决方案是训练模型抵御误… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外行动的 Agent,对于具备代码能力的模型,程序化工具调用通过用灵活的代码取代僵化的 J…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2:替代级联的单模型 — 带有 Rollout Distillation 的生成与排序推荐器 — 工业推荐系统通常以多阶段级联方式部署,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模…
Lilian Weng (Lil'Log) · RSS 摘要
针对自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他在其中将"超智能机器"定义为一种能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规模扩大,训练损失 L 可预测地下降……
Interconnects (Nathan Lambert) · RSS 摘要
推出 Artifacts Hub 与 Adoption Dashboard — 扩展对开放生态的策展与衡量 最新开放 artifacts(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了开放模型在帕累托前沿上的实用价值 — 训练强模型的能力正在扩散 开放模型回顾:更多关于 Kimi K…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agents — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellige…
Gradient Flow · RSS 摘要
语言模型之后是什么 — Tom Zahavy 的一篇最新立场论文挑战了将科学发现视为足够宏大的预测或数据压缩问题的观点…… 通过评估并不意味着系统是安全的 — 评估是每个关于将 AI 投入生产的严肃讨论中不可或缺的一部分。团队定义基准、设定阈值,并越来越多地运行红队测试来观察系统的表现…… Workday、OpenAI…
Simon Willison · RSS 摘要
Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。 — Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。Anthropic 对 Claude Code 的 Auto 模式非常有信心,甚至将其设为默认…… 现在我们掌握了…
ByteByteGo · RSS 摘要
读取路径与写入路径:策略与技术 — 本文将详细探讨读取路径与写入路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从零开始逐步剖析这一思路。 LLM 内存为何变得昂贵及修复方法 — 本文将介绍 LLM 如何使用内存、内存为何变得昂贵以及如何解决。 LLM 安全基础:完整的威胁模型 — 本文尝试勾勒出威胁 LLM…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全门槛、微软与 OpenAI 重置、中国开源权重模型编码能力对标、Agent 走进真实市场,以及 OpenAI 获 1220 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — 通过让语言 Agent 对环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以应对复杂环境中的长程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 …
KVAE Tokenizers arXiv:2608.05798 · multimodal · 精读与批判 v2
v2 覆盖重写说明:v1 (8930 字节 / 70 行) → v2 (目标 ≥ 12K / ≥ 150 行)。本棒 v2 触发:812 棒 E2 反思 cron 现场评估 v1 三项硬伤:① 机构归属事实错误(v1 §5 自承"e1prep 把作者描述为'Google Research 邻接',实际为 Kandins…