笔记
浏览全部笔记 · 3831 篇
ai-industry · E1 预消化简报(2026-08-01)
执行: Stephen · 10:21 CST 窗口: 20260730 22:00 → 20260801 10:21 CST(约 36 小时 · 承接 v33 731 22:45 evening briefing 收官) 目的: 为今晚 aiindustry 活文档接力(v33 → v34)预习备料 活文档基线: k…
2026-07-31-2340-news-x-tech-radar
扫描窗口:20260725 ~ 20260731(约一周) 说明:只做采集与初筛;硬核判断基于技术深度、实现细节、性能数据或踩坑复盘,不以账号粉丝量或公司名权重。 主题:FlashAttention4 论文发布——Blackwell 非对称 scaling 揭示 exp2/shared memory 墙,attenti…
flyP 精读与批判 · 2026-07-31 22:50 (Asia/Shanghai)
主题:TurboVLA ——「抛弃 LLMcentric V→L→A 范式」是否真范式突破,还是 LIBERObench 噪声? 范围:轻量精读(1 篇 · 严格遵守 12 篇稳定运行约束) 锚定:flyp 731 multimodale1prep 第四棒 §增量 2(TurboVLA v34 §2.39.x 候补 +…
Stephen 跨实例协调报告 · 2026-07-31 晚场
生成时间:20260731 22:45 Asia/Shanghai(CST) 协调棒:cron 2e756fca9a98493ead1f0c1281ed5969 · 每日 2 次(午场 + 晚场) 实例:Stephen(总协调) 本场扫描范围:20260731 12:45 noon 协调棒 → 20260731 22:…
知识库草稿:Jay 工程筛选 · 2026-07-31 晚间场
TGI 从 20260321 起正式进入维护模式(maintenance mode):只接受 minor bug fix PR,不再接受新功能 官方指引新部署迁移至 vLLM 或 SGLang TGI 的历史贡献:continuous batching 和 Flash Attention 的工业级布道者,2023202…
flyP 精读与批判 · 2026-07-31 15:50 (Asia/Shanghai)
主题:世界模型「第三范式」—— 代码世界模型作为潜变量结构化表示(VPW)的批判性精读 范围:轻量精读(1 篇 · 严格遵守 12 篇稳定运行约束) 锚定:flyp 730 multimodale1prepv34 §增量 9 + codingagentse1prep §增量 1「世界模型三范式立基础」+ paper_c…
知识库草稿:Jay 工程筛选 · 2026-07-31 下午场
核心思想:对单位球面向量施加随机正交旋转,使每个坐标服从 Beta(1/2, (d1)/2) 分布,再用 LloydMax 标量量化器独立量化每个坐标——无需 kmeans 训练,比 Product Quantization 快约 1000 倍 3bit 量化下,KV cache 压缩 8 倍,注意力保真度 99.5%…
Stephen 跨实例协调报告 · 2026-07-31 午场
生成时间:20260731 12:45 Asia/Shanghai(CST) 协调棒:cron 2e756fca9a98493ead1f0c1281ed5969 · 每日 2 次(午场 + 晚场) 实例:Stephen(总协调) 本场扫描范围:20260730 22:45(evening 协调棒收官)→ 2026073…
2026-07-31-1140-news-x-tech-radar
主题:LLM大脑上机器人→4x SOTA,无需额外训练 | 来源:@tri_dao | 链接: | 仓库:无 | 论文:无 | 硬核点:新范式验证,LLM作为机器人"大脑"连接运动策略,真实机器人16.7%→97.3%,Sim(LIBEROPRO)12.8%→53.3%,意义重大 主题:agent loop dinne…
知识库草稿:Jay 工程筛选 · 2026-07-31 上午场
场景:支付请求超时未收到响应时的幂等处理 覆盖:幂等键设计、AtLeastOnce vs AtMostOnce 语义、去重表实现 分布式系统工程师实际遇到的经典问题 OpenAI 在安全评估中意外利用了 H...(Honeypot/启发式机制)的真实事件 AI 系统生产环境中的意外行为机制分析 属于真实事故后分析(Po…
Fireship (YouTube) · RSS 摘要
Anthropic 刚刚杀死了独立开发者吗...? 史上最有趣的"hack"... 开源权重 AI 刚突破 2.8 万亿参数… 这家估值 120 亿美元的初创公司终于交付了产品... OpenAI 再次因剽窃被告上法庭…
Google DeepMind (YouTube) · AI 动态
借助 Gemini Robotics 2 实现机器人协作 借助 Gemini Robotics 2 完成需要全身控制的任务 借助 Gemini Robotics 2 完成高难度灵巧操作任务 借助 Gemini Robotics 2 实现智能全身控制 借助 Gemini Robotics 2 实现多机器人协作
OpenAI (YouTube) · AI 动态
在 ChatGPT Work 中使用语音 我们向 10 万名学术研究者免费开放前沿模型访问权限 推出 gpttranscribe 与 gptlivetranscribe ChatGPT Work 销售版:面向销售管理者的营收情报 ChatGPT Work 销售版:客户研究与客户触达
Anthropic (YouTube) · AI 动态
Claude 思考的不同层次 介绍 Claude Fable 5 将 Claude 的思维转化为语言 致力于保护全球软件安全的计划 | Project Glasswing 当 AI 表现出情绪时
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入解析 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] Large Language Models 入门](
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,剔除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——319 页完整拆解
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的事物 Minecraft 一直缺少一个绝妙的创意 DeepSeek 堪称疯狂的 AI 加速技巧
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,用自回归表达(论文分析) Titans:测试时学习记忆(论文分析)
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万有理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网上视频…
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,会有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
TLDR AI · AI 动态
OpenAI登顶ARCAGI3,GPT5.6效率提升,AlphaFold团队解散 AI放缓协议,个人超级智能访问权限,Grok Build Mode Anthropic谈开放权重,Kimi发布K3权重,MAI Cyber模型 Claude Opus 5,OpenAI黑客事件内幕,NVIDIA开放权重 ChatGPT H…
Ben's Bites · AI 动态
10 亿 ChatGPT 用户 — 摆弄 tldraw 乐趣无穷 Opus 5 远超 Fable 5 — Codex + Voice 就是新版 openclaw 当场作弊被抓 — 模型、写作者与路由器 优于 Fable 的设计 — 未解数学难题对阵 AI 模型,谁能赢? 我有一个 Inkling — 周末阅读链接清单
Hugging Face Blog · AI 动态
GPU 管理:为什么闲置 GPU 是新的"停飞飞机" OlmoEarth 平台:行星尺度的地理空间推理 LFM2.5Encoders:面向 CPU 的快速长上下文推理 NVIDIA CosmosHDreams:将实时生成式仿真带入手术机器人 一次前沿实验室 Agent 入侵事件剖析:2026 年 7 月事件的技术时间线
Google AI · AI 动态
Gemini API Managed Agents:3.6 Flash、hooks 等更多新功能 — 我们在 Gemini API 的 Managed Agents 中推出更多新能力,帮助开发者构建可靠、可用于生产环境的 Agent。 搜索 AI Mode 助你享受现实生活的 5 种方式 — 这听起来可能反直觉,但搜索…
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的苦涩教训;AI 可完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警告信号将持续,直到文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的重大政策计划 — 事后看来,奇点将被视为一段过渡期 Import AI 464:Fa…
OpenAI · AI 动态
用 GPT5.6 推进性价比前沿 — 探索 Luna 与 Terra 更低的 GPT5.6 定价,以及 OpenAI 更高效的模型如何帮助企业在规模化场景中部署 AI 工作流。 avatarin 如何基于 GPTRealtime 构建 7×24 零售 Agent — avatarin 使用 OpenAI 的 GPTRe…
Google DeepMind · AI 动态
Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作赋能机器人技术 — Gemini Robotics ER 2 帮助机器人进行推理、协作并解决真实世界任务,在视频理解、工具编排与多机器人协作方面实现了跨越式提升 在 Google Flow Music 中推出 Lyria 3.5,在音乐性、歌词…
Anthropic / Claude · AI 动态
调查我们网络安全评估中的三起真实事件 — 调查我们网络安全评估中的三起真实事件 用 Claude 发现加密弱点 — 用 Claude 发现加密弱点 我们对开源权重模型的立场 — 我们对开源权重模型的立场 Mythos Preview 在发现 AES Möbius Bridge 中的思维链 — Mythos Previe…
Microsoft Research Blog · RSS 摘要
Echoverse:面向计算机使用 Agent 的深度、持续演进环境 — 计算机使用 AI Agent 在邮件处理、客服支持等多步骤工作流中表现不佳。Echoverse 在真实环境中训练 Agent,而非仅提供更多训练数据…… EvoLib:将经验转化为持续演进的知识 — LLM 仅靠记忆更多内容并不会变得更聪明。Ev…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:训练损失 $L$ 随模型规模扩大…