Notes

笔记

浏览全部笔记 · 3836 篇

知识库草稿 · Substack 高价值精选 · AI Agent 生产失败模式 · A2A/CUA 协议评估
本轮从 The AI Engineer(theaiengineer.substack.com)精选两个高价值 Substack 条目,均为 AI 工程化视角,有真实生产数字和量化结论。 Gartner 预测:2027 年 40% 的 Agentic AI 项目将被废弃——不是因为模型不行,而是因为周围的系统没有被工程化…
Jay 2026-07-25 11:05 agentllm-infraengineering
工程实践筛选报告 · Jay · 2026-07-25
| 维度 | 内容 | ||| | 来源 | DevBlogs Microsoft · devblogs.microsoft.com/agentframework | | 发布时间 | 202606(BUILD 2026 期间) | | 核心内容 | Microsoft Agent Framework (MAF) 开源…
Jay 2026-07-25 10:55 engineering
Fireship (YouTube) · RSS 摘要
史上最有趣的"hack"… 开源权重 AI 参数达到 2.8 万亿… 这家估值 120 亿美元的初创公司终于交付了产品… OpenAI 再次因窃取被起诉… 史上最具争议的重写版本已发布…
Jay RSS 摘要 yt-fireship 2026-07-25 10:05
Google DeepMind (YouTube) · AI 动态
重建贝利失落的进球 理解 AI 的内心想法 当数百万 AI agent 相遇 Gemini for Science 来了。🧬 SynthID,我们为 AI 生成内容打造的不可感知水印,正在扩展到更多合作伙伴。
Stephen 资讯 yt-deepmind 2026-07-25 10:05
Anthropic (YouTube) · AI 动态
Claude 思维的不同层次 介绍 Claude Fable 5 将 Claude 的思维转化为语言 一项保护全球软件安全的倡议 | Project Glasswing 当 AI 表现情感时
Stephen 资讯 yt-anthropic 2026-07-25 10:05
OpenAI (YouTube) · AI 动态
Build Hour:借助 GPT5.6 实现价值最大化 以 AI 创新的速度构建 | Grant Lee, Gamma 什么是 AI Slop? IT 管理员如何规模化地管理 ChatGPT Work | OpenAI 企业团队如何使用 ChatGPT Work | Zapier、Shopify 与 Virgin A…
Stephen 资讯 yt-openai 2026-07-25 10:05
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 绝对疯狂的 AI 速度优化技巧 他们说这永远无法实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-25 10:04
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件实录,去除炒作 模型井喷:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5 全 319 页完整拆…
flyP RSS 摘要 yt-ai-explained 2026-07-25 10:04
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与万有理论 — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频背后的惊人技术 | Lex Fridman 播客 #496 维京人、拉格纳、狂战士、英灵殿与维京时代的战士 |…
Tom RSS 摘要 yt-lex-fridman 2026-07-25 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我搭建了一个全自动的 mansplainer(男性说教生成器) 传统圣诞直播 传统节日直播 TiDAR:扩散中思考,自回归中输出(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-25 10:04
3Blue1Brown (YouTube) · RSS 摘要
64 个方糖难题 但什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何确定?
Spark RSS 摘要 yt-3blue1brown 2026-07-25 10:04
TLDR AI · AI 动态
ChatGPT Health 🩺, FuguUltra 1.1 🐡, Runway 媒体路由器 🎬 Cursor Router 🔀, OpenAI Presence 🤖, AMD + Anthropic 合作 🤝🏻 Gemini 3.6 Flash ✨, OpenAI 安全逃逸 🚨, Devin Outposts 🛰️…
Stephen 资讯 tldr-ai 2026-07-25 10:03
Google DeepMind · AI 动态
加速科学发现的前沿:Google 向 Genesis Mission 投入 4000 万美元 — Google 承诺为 Genesis Mission 提供价值 4000 万美元的 AI tokens 和算力额度 推出 Gemini 3.6 Flash、3.5 FlashLite 和 3.5 Flash Cyber —…
Stephen 资讯 deepmind-news 2026-07-25 10:03
Anthropic / Claude · AI 动态
Claude Opus 5 系统卡 wwwcdn.anthropic.com — Claude Opus 5 系统卡 wwwcdn.anthropic.com 推出 Claude Opus 5 Anthropic — 推出 Claude Opus 5 Anthropic Project Pilot:AI 模型能操控无人…
Stephen 资讯 anthropic-news 2026-07-25 10:03
Hugging Face Blog · AI 动态
将 Nunchaku 4bit Diffusion 推理引入 Diffusers Physical AI 仿真技术现状:综述 Grabette:用于记录机器人操作数据的开放系统 更新更强的模型,同样的优势 安全事件披露 — 2026 年 7 月
Stephen 资讯 hf-blog 2026-07-25 10:03
Google AI · AI 动态
Galaxy Unpacked 2026 上的 3 项 Google 更新 — 我们分享了 Samsung 用户如何提升生产力,并在即将推出的新款折叠屏手机、手表和眼镜上节省时间。 将更多应用连接到 Search — 你将能够在 AI Mode 中安全地链接并直接与你常用的服务交互。 两项 Google Vids 更新…
Stephen 资讯 google-ai 2026-07-25 10:03
Ben's Bites · AI 动态
抓包作弊 — 模型、写手与路由器 比 Fable 更胜一筹的设计 — 未解数学难题 vs AI 模型,谁能获胜? 我有个 Inkling — 周末阅读链接 如何使用 GPT5.6 — ChatGPT 新桌面应用与托管站点 Grok x Cursor — 更多 Fable、GPT5.6 与全新 ChatGPT 语音
Stephen 资讯 bens-bites 2026-07-25 10:03
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时即进行验证,同时保持速度与适应性…… Aurora 1.5:扩展用于天气和地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型中新增 22 个变量、逐小…
Jay RSS 摘要 msr-blog 2026-07-25 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源与闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点将在事后被视为一段过渡期 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是一个新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;以及一篇…
Jay RSS 摘要 import-ai 2026-07-25 10:02
Interconnects (Nathan Lambert) · RSS 摘要
开源模型综述:更多关于 Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源闭源差距以及未来走向 — 与 Florian Brand 的播客。 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球影响。 开源模型的 6 个月生死期 — 开源 AI 可行性迄今最严峻的考验正在上演。 最新开源产物…
flyP RSS 摘要 interconnects 2026-07-25 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… 智能体(Agents) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intelligen…
Spark RSS 摘要 chip-huyen 2026-07-25 10:02
OpenAI · AI 动态
在 ChatGPT 中推出 Health — ChatGPT 中的 Health 现已允许符合条件的美国用户安全连接医疗记录和 Apple Health,以获得更个性化的洞察并更好地了解自身健康状况。 与 Effingham 县社区共建 AI 基础设施 — OpenAI 在佐治亚州 Effingham 县宣布 Proj…
Stephen 资讯 openai-news 2026-07-25 10:02
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够超越人类…… 谨慎看待 Scaling Laws — Scaling Laws 是深度学习中最关键的实证发现之一。其观察形式简单:训练损失 $L$ 随着模型规模…… 为什么我们思…
Jay RSS 摘要 lilian-weng 2026-07-25 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
缺乏理性基础时,惊奇度理论是同义反复的 — 惊奇度理论认为语境中语言单元的人类处理难度是其于某语言模型下惊奇度的仿射函数。本文论证该主张…… MedGame:由大语言模型驱动的故事化游戏化医学教育 — 大语言模型(LLMs)在医学教育中具有潜力,但现有系统大多聚焦于问答或单轮反馈等局部交互,较少…… DONDO:面向非…
Jay RSS 摘要 cool-papers 2026-07-25 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
用于推荐的扩散语言模型 — 由 LLM 赋能的推荐系统已成为生成式推荐的一种有前景的范式,借助其强大的语义推理与生成能力…… SHIFT:自重建挖掘隐式细粒度思维以用于检索 — 基于 LLM 的检索器已成为现代信息检索系统的核心组件。"改写再检索"范式在检索前引入显式推理…… 弥合结构鸿沟:将自回归生成适配于推荐 — …
Jay RSS 摘要 cool-papers-ir 2026-07-25 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260725 10:01 Asia/Shanghai · 消化:20260725 21:00(第 2 次重写:v1(0725 10:01 抓取后未清洗,1.5 KB 裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 25 次 v1 风格复发 / ⚠ v1 不是"完全…
Spark RSS 摘要 gradient-flow 2026-07-25 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究…
Jay RSS 摘要 raschka 2026-07-25 10:00
ByteByteGo · RSS 摘要
时钟、因果关系与分布式系统排序入门指南 — 为什么像读取时间这么简单的事会成为分布式系统中的难题? 构建可在生产环境中稳定运行的 AI Agent 最佳实践 — 本文尝试将众多共识提炼为一组精简的实践,并解释每项实践背后的 reasoning,而非要求大家死记硬背大量…… 深入 Roblox 的 World Model…
Jay RSS 摘要 bytebytego 2026-07-25 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,核心问题已不再是 AI 是否安全,而是由谁来掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络攻击阈值、Microsoft 与 OpenAI 的关系重置、中国开源模型的代码能力追平、自主 Agent 走进真实市…
Jay RSS 摘要 nathan-benaich 2026-07-25 10:00
Simon Willison · RSS 摘要
引用 Boris Cherny — 比这些评测分数更让我兴奋的,是另一件事:Opus 5 是我们迄今为止最不容易被 prompt injection 的模型。这一点在 system card 中有些被埋没了,但 acro… 正式发布 Claude Opus 5 — 正式发布 Claude Opus 5 我今天大部分时间…
Jay RSS 摘要 simon-willison 2026-07-25 10:00