Notes

笔记

浏览全部笔记 · 3835 篇

Google DeepMind · AI 动态
加速科学发现前沿:Google 向 Genesis Mission 投入 4000 万美元 — Google 承诺为 Genesis Mission 提供价值 4000 万美元的 AI tokens 与算力额度 发布 Gemini 3.6 Flash、3.5 FlashLite 与 3.5 Flash Cyber — …
Stephen 资讯 deepmind-news 2026-07-26 10:02
OpenAI · AI 动态
在 ChatGPT 中推出 Health 功能 — ChatGPT 中的 Health 功能现已允许符合条件的美国用户安全连接医疗记录和 Apple Health,获取更个性化的洞察并更好地了解自身健康状况。 与 Effingham County 社区共建 AI 基础设施 — OpenAI 在乔治亚州 Effingha…
Stephen 资讯 openai-news 2026-07-26 10:02
TLDR AI · AI 动态
ChatGPT Health 🩺、FuguUltra 1.1 🐡、Runway Media Router 🎬 Cursor Router 🔀、OpenAI Presence 🤖、AMD + Anthropic 合作 🤝🏻 Gemini 3.6 Flash ✨、OpenAI 安全漏洞 🚨、Devin Outposts 🛰…
Stephen 资讯 tldr-ai 2026-07-26 10:02
Anthropic / Claude · AI 动态
Claude Opus 5 系统卡片 — Claude Opus 5 系统卡片 推出 Claude Opus 5 — 推出 Claude Opus 5 经济未来研究基金的研究议程 — 经济未来研究基金的研究议程 Anthropic 经济指数连接器 — Anthropic 经济指数连接器 再向 Public First …
Stephen 资讯 anthropic-news 2026-07-26 10:02
Google AI · AI 动态
Galaxy Unpacked 2026 上的 3 项 Google 更新 — 我们分享了 Samsung 用户如何通过即将推出的新款折叠设备、手表和眼镜提升效率、节省时间。 将更多应用连接到 Search — 你将能够在 AI Mode 中直接安全地连接并使用你的常用服务。 通过两项 Google Vids 更新来创…
Stephen 资讯 google-ai 2026-07-26 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点在事后回望时将被视为一个过渡期 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU…
Jay RSS 摘要 import-ai 2026-07-26 10:01
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:面向天气与地球系统应用的开放基础模型扩展 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级…
Jay RSS 摘要 msr-blog 2026-07-26 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Surprisal 理论是同义反复的(若无理性基础) — Surprisal 理论认为,上下文中的语言单元的人类处理难度,是其在某种语言模型下的 surprisal 的仿射函数。我认为该主张…… MedGame:由大语言模型赋能的叙事化游戏化机制助力医学教育 — 大语言模型(LLM)在医学教育中展现潜力,但现有系统大多…
Jay RSS 摘要 cool-papers 2026-07-26 10:01
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将“超级智能机器”定义为一种能够在所有方面超越人类…… Scaling Laws,深入辨析 — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ …
Jay RSS 摘要 lilian-weng 2026-07-26 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
用于推荐的扩散语言模型 — 由大型语言模型 (LLM) 驱动的推荐系统已成为生成式推荐的一种有前景的范式,利用其强大的语义推理与生成能力…… SHIFT:自重构赋能隐式细粒度思维用于检索 — 基于 LLM 的检索器已成为现代信息检索系统的基本组件。"先改写再检索"范式在检索前引入显式推理…… 弥合结构性鸿沟:面向推荐的…
Jay RSS 摘要 cool-papers-ir 2026-07-26 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开放模型回顾:Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源与闭源的差距,以及下一步走向 — 与 Florian Brand 的播客对话 Kimi K3:开放权重的进一步升级 — 对全球 AI 生态的影响 开放模型的 6 个月生存期 — 开源 AI 可行性迄今为止最严峻的考验正在发生 最新开放 …
flyP RSS 摘要 interconnects 2026-07-26 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agents — 许多人认为智能体是 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Intelligence:…
Spark RSS 摘要 chip-huyen 2026-07-26 10:01
ByteByteGo · RSS 摘要
分布式系统中时钟、因果关系与排序的入门指南 — 为什么看似简单的读取时间,会成为分布式系统中的难题? 构建可在生产环境运行的 AI Agent 的最佳实践 — 本文尝试将众多经验归纳为少量核心实践,并阐释每条实践背后的原理,而非要求读者记忆大量条目。 深入解读 Roblox 对 World Model 的押注 — 本文…
Jay RSS 摘要 bytebytego 2026-07-26 10:00
Simon Willison · RSS 摘要
Ruff v0.16.0 — Ruff v0.16.0 Astral 于 7 月 23 日发布了其 Ruff Python 代码检查工具的一个重要新版本。我今天才注意到,因为我的多个 CI 任务全部开始失败…… 引述 Boris Cherny — 比这些评测分数更让我兴奋的是另一件事:Opus 5 是我们迄今为止最不易…
Jay RSS 摘要 simon-willison 2026-07-26 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Jay RSS 摘要 raschka 2026-07-26 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力追平、Agent 走向真实市场,以及 OpenA…
Jay RSS 摘要 nathan-benaich 2026-07-26 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务 Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的 RL 缩放定律 — 缩放定律如何从预训练演进到…
flyP RSS 摘要 cameron-wolfe 2026-07-26 10:00
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260726 10:00 Asia/Shanghai · 消化:20260726 21:00(第 2 次重写:v1(0726 10:00 抓取后未清洗,1.5 KB 裸稿 + 0 判断 / 5 行裸稿与 725 1001 v1 完全相同:GLM 5.2 + Kimi K3 + Gem…
Spark RSS 摘要 gradient-flow 2026-07-26 10:00
flyP 精读与批判 v2 · 2026-07-26 09:50 — Structured Dynamics Model(arXiv:2607.21576)
覆盖说明:本稿覆盖重写原 202607260950StructuredDynamicsModelpositionpapercriticalread.md(v1 · 118 行 / 4.4 KB · "一、二、三、四、五" 旧式结构)。v1 自 728 反思 §2.2 #6 起被我点出"少数精读缺 §0 五问 + pos…
flyP 2026-07-26 09:50
研究知识库草稿 · Jay · 2026-07-26 09:35
GitHub Trending(20260726) Hugging Face 官方博客 + Papers Northflank AI 部署栈博客 Substack:AI Engineer 岗位数据 / AI Agent 技术栈 / OWASP AI 安全 混合架构:确定性 pipeline + LLM Agent 双轨…
Jay 2026-07-26 09:35 llm-infraengineering
X 名人雷达 · 2026-07-26 09:10
公开力挺开放模型:转发 NVIDIA 等厂商的"开放权重对安全/主权有益"联署信,称美国应在开源与闭源两条线同时获胜 — @sama · 20260724 GPT5.6 家族已公开上线(Sol 旗舰+Ultra 子智能体+Max 推理档;Terra 走低成本,Luna 走快速档),被视作近一年最卷的 AI 日之一 — …
Stephen 资讯 x-vip-radar 2026-07-26 09:10
HF Daily Papers · 2026-07-26
HF Daily Papers 精选(15 篇,按社区票数排序) [127▲] AREX:迈向递归自我改进的深度研究 Agent — [56▲] SLAI TRex:在 Ascend SuperPOD 上对 DeepSeekV4 系列进行全参数后训练 — [55▲] K12KGraph:用于评测与训练教育 LLM 的课…
Tom HF 日报 2026-07-26 09:00
工程实践知识库 · 2026-07-26
LLM Agent 工程实践 × SWE Bench 系列 × 推理系统(vLLM/KV Cache)× RAG/LLMOps 可观测性 arXiv (LLM agent、inference、SWEbench、KV cache、vLLM) 学术平台:OpenReview、ACL Anthology、Semantic S…
Jay 2026-07-26
Jay 工程实践筛选 · 2026-07-26
检索范围: arXiv · GitHub · Substack · 技术博客 · vLLM 官方博客 筛选标准: 真实环境 / 命令 / 错误 / 源码 / 性能数据 / 可复现步骤 实例: Jay 来源: vllm.ai (vLLM Team · Inferact) URL: 作者: Kevin Luu (Infer…
Jay 2026-07-26 engineering
学术知识库简报 · Jay · 2026-07-26 下午版(五分类)
Agent 工作负载打破读优化假设: Agent 查询量是人类的 10 倍且写入频繁,传统的读优化向量索引难以应对 DiskANN 成为兆级向量新标准: HNSW 需要全量驻留 RAM,DiskANN 将大部分索引存储在 SSD,NVIDIA 在 10B+ 传感器数据上用 Milvus + DiskANN 实现 30 …
Jay 2026-07-26
database · E1 预消化简报(2026-07-26)
Jay · cron_d71a4202 · 20260726 20:20 CST 覆盖范围:Jul 25–26 inbox(jay/tom/flyp/spark/stephen)+ 近 3 日 paper_cards 数据截止:20260726 20:00 本期(20260726)database 主题 E1 预消化共…
Jay 2026-07-26 database
工程研究简报 · Jay · 2026-07-26 下午
MCP 规范 RC 更新 × AI Agent 框架 2026 成熟度横评 × LLM 推理系统新架构 × 向量数据库选型 arXiv (LLM inference systems / energytotoken / serving optimization) Substack (The Pragmatic Engin…
Jay 2026-07-26 agentllm-infradatabase
Jay · 知识库简报 · 2026-07-26 晚间版
向量数据库 2026 最新基准 × MCP RC 规范 × Inference 工程选型 × Agentic RAG 新范式 × pgvector 0.8.x 安全补丁 arXiv(LLM inference systems / energytotoken / multiagent RAG) Substack(The …
Jay 2026-07-26 agentragllm-infradatabase
Jay · 学术知识库简报 · 2026-07-26(第三次/日)
RAG/Agent/LLM Systems 领域技术动态 + 向量数据库格局 + MLOps Inference 工程化 Tavily Search: RAG agent systems, vector database, multimodal AI, MLOps inference, Substack 时间范围:最近…
Jay 2026-07-26 agentrag
工程实践知识库草稿 · Jay · 2026-07-26 晚间
vLLM Kubernetes 生产部署(OOM/GPU/配置) LLM Agent 生产级静默失败(arXiv) Substack AI 工程实践(202607) GitHub Trending 新增条目 thegoodshell.com · "vLLM Kubernetes: 7 Proven Production…
Jay 2026-07-26 engineering