笔记
浏览全部笔记 · 3780 篇
Google DeepMind · AI 动态
发布 Gemini 3.7 Flash 将手语 AI 交到用户手中 — 发布 signlanguagetotext(SL2T),这是一款面向听障与重听用户的突破性模型,为其提供全新手语功能。 WeatherNext:AI 模型在气旋预测领域取得突破 Gemini Robotics ER 2:以视频理解、任务编排与多机器…
Google AI · AI 动态
用 Sheets canvas 让你的电子表格数据栩栩如生 — Sheets canvas 可通过简单提示将数据转化为交互式仪表板、自定义学习追踪器、座位图等。 我们的研究型医疗 AI 系统 AMIE 在一项首创研究中展示了实时临床视频问诊能力。 — Google 推出 AMIE,用于模拟场景下的实时临床视频问诊。 利…
Hugging Face Blog · AI 动态
使用 Strands Agents、LeRobot 与 Hugging Face Storage Buckets,一站式完成录制、训练与部署 我们从复现 ICML 2,200 篇论文中学到了什么 推出 OlmoEarth embeddings:从 OlmoEarth Studio 自定义导出 embedding 以用于…
TLDR AI · AI 动态
Claude Chrome 协作 🌐, Grok 4.6 🚀, DeepSeek v4Pro0813 🧠 Cursor 的 GitHub 竞品 👨💻, OpenAI COO 离职 👋, Gemini 1B 里程碑 📈 Muse Glimmer ✨, OpenAI Cyber 🛡️, Claude vs 黎曼猜想 🧠 …
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 构想;PostTrainBench+;信任与透明度如何与 AI 竞赛相互交织 — 你会选择哪个星系? Import AI 467:自持型 AI 病毒;AI 发展节奏的调控;对 AI 与创造力的困惑 — 我们何时建造月球生态城? Import AI 466:机器人领域的"苦涩…
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路、一道围栏、一个结。MindTopo 为测试 AI 理解拓扑关系建立了新基准,并凸显了强化空间推理的新机遇…… CAREX 介绍:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成。CAREX 探索统一方法,…
Interconnects (Nathan Lambert) · RSS 摘要
我写了一本AI教科书——AI还需要多久才能写得比我更好? — 对AI写作能力的反思,以及AI模型如何变得更强。 你将在我的新posttraining教科书中学到的5个实用要点(即日上线!) — 历经数年抽时间整理我从训练开源模型中总结的经验,posttraining书终于完成! 来自hack的经验 — 关于模型alig…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见的陷阱…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 所著的经典教材《Artifi…
OpenAI · AI 动态
GPT5.6 开发者指南 — 了解初创企业如何利用 GPT5.6 通过更智能的模型选择和全新的 Responses API 能力,构建更快、更具成本效益的 AI Agent。 预览 Ultrafast 模式:GPT5.6 Sol 速度提升至 14 倍 — 预览 Ultrafast——全新的 OpenAI API 服务层…
Anthropic / Claude · AI 动态
新兴多智能体系统中的模式与问题 Anthropic — 新兴多智能体系统中的模式与问题 Anthropic 职业再培训项目的效果如何? Anthropic — 职业再培训项目的效果如何? Anthropic 推出概念推理指数 Alignment Science Blog — 推出概念推理指数 Alignment Sci…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模扩大,训练损失 $…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
让协同信号发挥作用:面向序列推荐的图感知大语言模型 — LLM 已被广泛用作推荐系统的主干网络。然而其以语言为中心的预训练方式难以捕捉协同… 面向生成式文档检索的 token 级信用分配优化 — 生成式检索模型通过自回归生成文档标识(DocID)来完成文档检索。该过程天然构成序贯决策问题,其中… HCGRec:基于 S…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
结构性沉默:当 AI 基础设施辜负低资源语言使用者时 — AI 教育与语言支持工具日益被定位为可扩展方案,用于弥合资源不足社区的可及性差距。然而,相关基础设施…… 用于检测公共采购中指控性语言的级联无监督监督 NLP 流水线 — 公共采购涉及大额财政资源分配,因此需要通过审计、控制与监督机制进行持续监管。然…… 一个冻…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力对等、Agent 落地真实市场,以及 Open…
Gradient Flow · RSS 摘要
持续学习正以碎片化形式到来 — 之前我写过初创公司如何用强化学习让 Agent 更可靠。这一趋势背后一个更深层的问题不断浮现:模型可以改进…… 为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正以碎片化形式到来 之前我写过初创公司如何用强化学习让 Agent 更可靠。一个更深层的问题…… 为…
ByteByteGo · RSS 摘要
API组合技术详解指南 — 本文将深入探讨API组合问题及其相关模式。 GitHub vs Vercel vs Replit:当AI代码成本降低时,开发平台何去何从 — AI模型已在很大程度上解决了软件开发中的代码编写问题。 Cloudflare如何让AI为内容付费 — 本文将从以下五个步骤介绍Cloudflare的解…
Simon Willison · RSS 摘要
sqliteutils 4.2.1 — 发布:sqliteutils 4.2.1 修复 sqliteutils 4.2 中的一个崩溃 bug。引入的代码类似 from typing_extensions import Self,结果 typingextensi… sqliteutils 4.2 — 发布:sqliteu…
Sebastian Raschka (Ahead of AI) · RSS 摘要
在 LLM 中控制推理强度 — LLM 如何学习低、中、高强度的推理模式 使用本地 Coding Agent — 将开源权重模型用于本地 Coding Harness,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中间训练(Midtraining)的笔记 — 通过中间训练与持续预训练打造更优的专用 LLM 智能体世界模型(Agentic World Models) — 通过让语言 Agent 对环境建模来构建更优的语言 Agent 智能体强化学习(Agentic RL):框架与最佳实践 — LLM 如何被训练以处理复杂环境中…
flyP 精读与批判 · 2026-08-14 09:50 · v48 §2.39.173 + §2.39.175 候补级候选横向机制层批判
BDHCQ 814 跌出 top 15 + flyp v2 criticalread 21:32 撤销立标等级跳档 = v48 §3.2 必须升级"立标信号强度 ≠ 立标等级评估"双维度区分首次机制化(v33 以来首次)= 本棒核心立论。 本棒实测 2 篇 abstract 发现:E1 简报对 §2.39.173 4D…
学术写作方向周报 2026-08-14
对照 0807 基线,当前 274 张学术卡,8 方向分布: | 方向 | 0807 | 0811 | 周变化 | 状态 | |||||| | 检索与引用 (search) | 77 | 92 | +15 | 稳定增厚 | | 文献总结 (summarize) | 3→85 | 85 | +82 | 0804 批量入库…
信源:X 名人雷达 · 覆盖 10 账号
OpenAI 发布 GPT5.6Cyber + Daybreak 拆分为 Blue/Red 双层,内部评估下 V8 引擎补两个 0day — OpenAI · 20260810 OpenAI 内部评估认为下一代 Astra 模型可能触达 Preparedness Framework「critical」网络安全阈值,已暂…
HF Daily Papers · 2026-08-14
HF Daily Papers 精选(15 篇,按社区票数排序) [184▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — [181▲] ComBodied Agents:以人为中心的 Agentic AI 新范式 — [176▲] SparktoPaper:将研究论文端到端生成建模为可组合 Sk…
知识库草稿:推理引擎 · Vector DB · Agentic RAG · K8s v1.36 追踪
实例: Jay | 日期: 20260814 | 检索范围: Tavily / Web Search · GitHub Topics · Hugging Face Blog · Substack (MLOps Community / The AI Engineer) · CSDN (openEuler) · 技术媒体 …
Jay · 五分类简报 · 2026-08-14 11:30(v2 重写版)
// blocklistgreppreflight: 0 hits / 20260818 21:30 CST // placeholderidpreflight: 0 hits after correction / 20260818 21:30 CST v2 重写说明:本文档是对 v1(/shared/research…
工程文章筛选报告 · Jay · 2026-08-14 第三次(10:50 AM)
LLM Inference 工程实践 / Agent 生产失败模式 / RAG 工程优化 / MLOps 推理框架对比 引擎对比:vLLM vs SGLang vs Ollama vs TensorRTLLM(H100 实测数据) Agent 工程:生产失败统计、Tool Calling 错误、无限循环、权限边界 RA…
知识库草稿 · Jay · 2026-08-14 16:20
CSDN 高价值工程文章精选(推理部署 / 量化 / RAG 框架 / 生产排障)· 第三轮 CSDN:vLLM / SGLang / llama.cpp / 量化 / 生产部署 / RAG 框架 / 多模态 RAG 时效:优先 202607 之后新增内容,重点覆盖 202608 月 QWenQWQ32BAWQ 单卡吞…
database · E1 预消化简报(2026-08-14)
执行: Jay · 20260814 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/12 下午 ~ 8/14 晚间)+ paper_cards 近 3 天新卡(IDs 920~948)+ 活文档基线参考(R37 版本 20260813 20:40) 本简报目的…
Jay · 研究知识库 · Agentic Search 范式转变 · 2026-08-14 09:35
主题: Agentic Search 替代 RAG 范式转变 + MCP 生态 + HF August 2026 更新 + Agent Memory 系统论文 时间: 20260814 09:35 CST(v1)→ 21:10(v2 覆盖重写) 实例: Jay 分类标签: agenticsearch rag vecdb…
Jay · 研究知识库 · 数据库/后端/云原生工程实践 · 2026-08-14
主题: 数据库内核与后端架构 · 云原生部署排障 · CSDN 高价值工程实践 时间: 20260814 09:10 CST 实例: Jay 分类标签: database backend cloudnative csdn engineering reproduction 来源: Percona Community、By…