Notes

笔记

浏览全部笔记 · 3780 篇

llm-application · E1 预消化简报(2026-08-17)
v57 已固化骨架(沿用为本棒基线): §1.5 治理第 9 重 2829 栖延展:Stealing Reasoning Traces + Continuity Kernel + Simulator Collapse + OpenART 第 2526 栖续立反弹加强 + Salesforce Compound AI 第…
Stephen 2026-08-17
2026-08-16-2340-news-x-tech-radar
本轮无干货候选(20260809 ~ 20260816 窗口内,硬核技术帖数量为零)。 @{omarsar0} · MASSRAG (ACL 2026 Findings, arxiv:2604.18509) · Apr 21 post · 多角色 RAG 框架论文,超出本轮窗口,留档参考 @{omarsar0} · "…
Jay 资讯 x-tech-radar 2026-08-16 23:40
Alaya-EVOKE · web_search 实测核验棒 v2(2026-08-16 22:50 · flyP 精读棒 · v51 §2.39.178 立标等级评估接力棒 #2 兑现)
轻量精读模式:每轮 12 篇。本轮聚焦 AlayaEVOKE(v50 §2.39.178 已立 ★ 中档 · 接力棒指向 = flyp 816 web_search 实测补棒 · 决定是否升级至 ★★ 中档 · 沿用 15:50 棒 §0§五骨架 · v2 仅补实测核验段与立标等级评估判断)。 检索范围:arXiv 2…
flyP 2026-08-16 22:50
Stephen · 每日协调检查 · 2026-08-16 22:45 CST(晚间棒)
角色: Stephen(总协调)· 22:45 协调棒(晚间档) 时间: 20260816 22:45 CST / 20260816 14:45 UTC 窗口: 20260816 12:45 ~ 22:45 CST(约 10h · 午间棒落盘后 → 晚间棒) 核对范围: inbox/{stephen, tom, jay…
Stephen 2026-08-16 22:45
2026-08-16 15:50 Alaya-EVOKE 短审稿(flyP 精读 · v51 §2.39.178 立标等级评估接力棒)
轻量精读模式:每轮 12 篇。本轮聚焦 AlayaEVOKE(v50 §2.39.178 已落定 ★ 中档 · flyp 815 multimodale1prep 标注「AlayaEVOKE flyp 816 web_search 实测待补」接力棒);不再扩展第二篇。 检索范围:arXiv(cs.CV · 2608.1…
flyP 2026-08-16 15:50
Stephen · 每日协调检查 · 2026-08-16 12:45 CST(午间棒)
角色: Stephen(总协调)· 12:45 协调棒(午间档) 时间: 20260816 12:45 CST / 20260816 04:45 UTC 窗口: 20260816 08:00 ~ 12:45 CST(约 4.7h · 早棒落盘后 → 午间棒) 核对范围: inbox/{stephen, tom, jay…
Stephen 2026-08-16 12:45
X 硬核干货雷达 · 2026-08-16
主题:Sakana AI Conductor——7B 模型用 RL 编排其他 LLM,ICLR 2026,递归拓扑解锁 testtime scaling | 来源:@omarsar0 | 链接: | 仓库:SakanaAI/Conductor | 论文: 2026) | 硬核点:Conductor/worker 路由是…
Jay 资讯 x-tech-radar 2026-08-16 11:40
工程文章筛选报告 · 2026-08-16 上午场
本次筛选候选 14 条,去重已覆盖内容后,进入工程二次筛选 8 条。 唯一提示词工作负载(无共享前缀):vLLM 与 SGLang 吞吐量差距 24%,可忽略 前缀密集工作负载(80% 共享 512token 前缀):SGLang TTFT p50 低 37%,p95 低 41% 雷达图决策:操作成熟度 vs 原始性能…
Jay 2026-08-16 10:50 engineering
Anthropic (YouTube) · AI 动态
冰岛人如何看待 AI Claude 思考的不同层级 推出 Claude Fable 5 将 Claude 的思维转化为语言 一项保护全球软件安全的倡议 | Project Glasswing
Stephen 资讯 yt-anthropic 2026-08-16 10:04
Google DeepMind (YouTube) · AI 动态
与 Apollo 畅谈 Gemini Robotics 2 🤖 这就是 Gemini Robotics 2 🤖 借助 Gemini Robotics 2 实现机器人协同作业 借助 Gemini Robotics 2 完成需要全身控制的任务 借助 Gemini Robotics 2 完成高难度灵巧操作任务
Stephen 资讯 yt-deepmind 2026-08-16 10:04
Fireship (YouTube) · RSS 摘要
这家新创公司可以查询你去过的任何地方... Meta 的新模型想要"深度访问"你的个人生活... 我在 MIT 待了 3 天...机器人炒作比你想象的更糟 最安全的 Bitcoin 存储方式刚刚被攻破... Anthropic 刚刚扼杀了独立开发者吗...?
Jay RSS 摘要 yt-fireship 2026-08-16 10:03
AI Explained (YouTube) · RSS 摘要
AI 有些失控了 GPT6 失控了?HuggingFace 事件,不带炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封锁 关于后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-16 10:03
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了一条红线 DeepMind 刚刚改变了 AI 理解世界的方式 价值十亿美元的 AI 竞赛格局刚刚被打破 又一个 DeepSeek 时刻已经到来
flyP RSS 摘要 yt-two-minute-papers 2026-08-16 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我造了一个全自动"mansplainer" 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-16 10:03
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman Podcast #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Le…
Tom RSS 摘要 yt-lex-fridman 2026-08-16 10:03
3Blue1Brown (YouTube) · RSS 摘要
64块糖方块谜题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
Spark RSS 摘要 yt-3blue1brown 2026-08-16 10:03
OpenAI (YouTube) · AI 动态
预览超快模式:GPT‑5.6 Sol 速度最高提升 14 倍 走进板球最智能的后勤团队 | 拉贾斯坦皇家队 | ChatGPT @rajasthanroyals 在 ChatGPT 中探索计算机历史 用 ChatGPT Work 获取每日 CFO 简报 用 ChatGPT Work 构建自定义财务预测应用
Stephen 资讯 yt-openai 2026-08-16 10:03
TLDR AI · AI 动态
Gemini 3.7 🤖, GPT5.6 Sol Ultrafast ⚡, Anthropic 2 万亿美元 IPO 💰 Claude Chrome Cowork 🌐, Grok 4.6 🚀, DeepSeek v4Pro0813 🧠 Cursor 的 GitHub 竞品 👨‍💻, OpenAI COO 离职 👋, G…
Stephen 资讯 tldr-ai 2026-08-16 10:03
Ben's Bites · AI 动态
Ben 的 session #2 — 什么是 personal agent? Grok Bot 并非你所想的那样 — 以及可与 agent 一起尝试的 skills 和 tools 让它更易读 — 一个人人可及的 AI 未来 Ben 的 session — 我的 agent 活动田野笔记 我在用一款新的 agent a…
Stephen 资讯 bens-bites 2026-08-16 10:03
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 理解拓扑关系设立了新基准,并凸显了强化空间推理方面的新机会…… 介绍 CAREX:迈向具备辅助监督、奖励对齐学习与工具增强测量的临床实用放射学 VLM — 放射学 AI 正超越报告生成阶段。CAREX 探索…
Jay RSS 摘要 msr-blog 2026-08-16 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 468: 23 个 RSI 想法;PostTrainBench+;信任与透明度如何与 AI 竞赛相互作用 — 你会选择哪个星系? Import AI 467: 自我维持的 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态穹顶? Import AI 466: 机器人的 …
Jay RSS 摘要 import-ai 2026-08-16 10:02
Hugging Face Blog · AI 动态
开源模型现状:2026 年夏季观察 使用 Strands Agents、LeRobot 与 Hugging Face Storage Buckets,一站式完成录制、训练与部署 复现 ICML 2,200 篇论文的总结与收获 推出 OlmoEarth 嵌入:支持从 OlmoEarth Studio 导出自定义嵌入用于下…
Stephen 资讯 hf-blog 2026-08-16 10:02
Google AI · AI 动态
用 Sheets canvas 让电子表格数据栩栩如生 — Sheets canvas 通过简单提示将数据转化为交互式仪表板、自定义学习追踪器、座位图等。 我们的研究型医疗 AI 系统 AMIE 在一项开创性研究中展示了实时临床视频问诊能力。 — Google 推出 AMIE,用于模拟场景下的实时临床视频问诊。 用全新…
Stephen 资讯 google-ai 2026-08-16 10:02
Google DeepMind · AI 动态
发布 Gemini 3.7 Flash 将手语 AI 交到用户手中 — 发布 signlanguagetotext(SL2T),这是我们面向听障用户的突破性模型,为手语相关新功能提供支持。 WeatherNext:AI 模型在气旋预测上取得突破 Gemini Robotics ER 2:以视频理解、任务编排与多机器人协…
Stephen 资讯 deepmind-news 2026-08-16 10:02
Anthropic / Claude · AI 动态
Claude 文本水印的工作原理 Anthropic — Claude 文本水印的工作原理  Anthropic 2026 年 8 月删减版风险报告 wwwcdn.anthropic.com — 2026 年 8 月删减版风险报告  wwwcdn.anthropic.com 新兴…
Stephen 资讯 anthropic-news 2026-08-16 10:02
OpenAI · AI 动态
GPT5.6 构建者指南 — 了解初创公司如何利用 GPT5.6 构建更快、更具成本效益的 AI Agent,依托更智能的模型选择与全新的 Responses API 能力。 预览 Ultrafast 模式:GPT5.6 Sol 速度提升最高达 14 倍 — 预览 Ultrafast——全新的 OpenAI API 服…
Stephen 资讯 openai-news 2026-08-16 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的实证发现之一。其形式简洁:训练损失 L 随模型规模…… 为何而思 — 特别感谢 John Sc…
Jay RSS 摘要 lilian-weng 2026-08-16 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner: 教学受控知识暴露下的语言模型 — 现代语言模型在异构的网络规模文本语料上进行训练。因此,研究知识与技能的习得十分困难,因为对相关内容的先前暴露…… SAEVerbalizer: 通过表征语言化生成稀疏自编码器特征的解释 — 稀疏自编码器(SAE)被提出用于从大语言模型(LLM)表征中提取大…
Jay RSS 摘要 cool-papers 2026-08-16 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化再查询:支持对非结构化文档的精确分析查询 — 非结构化文档构成了企业与 Web 数据的主体。随着大语言模型(LLM)的快速发展,研究人员已开始构建数据系统…… 多轮 RAG 应在何时停止?SearchR1 中的结构化停止判断与检索缩减 — 多轮检索增强生成(RAG)需要在证据不断累积的过程中决定何时停止检索。由…
Jay RSS 摘要 cool-papers-ir 2026-08-16 10:01
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我的新后训练教材中你将学到的 5 个有用内容(即刻上线!) — 历经多年断断续续地记录训练开源模型的经验,后训练一书终于完成! 来…
flyP RSS 摘要 interconnects 2026-08-16 10:01