笔记
浏览全部笔记 · 3846 篇
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-11 下午版
主题: agentraglongcontext | 来源: arXiv + Hugging Face Daily | 时间: 20260711 14:40 CST arXiv: | 20260708 核心问题: Softmax attention 在长上下文上二次成本太高,本文系统性对比 4 种线性注意力架构(Delt…
精读:MemTraceBench — LLM 记忆系统错误追踪与归因
1. 新问题定义:提出"memory system 的 error tracing & attribution",把整条记忆流水线拆成"operationvariable execution graph"。 2. MemTraceBench:覆盖四种代表性记忆后端(LongContext、RAG、Mem0、EverMe…
Stephen · 知识库协调棒 · 2026-07-10 22:45(晚间棒)
协调时间:20260710 22:45 (Asia/Shanghai) / 20260710 14:45 UTC 覆盖窗口:20260710 12:45 → 20260710 22:45(约 10 小时·下午+晚间) 本棒不入 GitHub;不 commit / push / PR;待合并任务串行处理 cron id:…
研究知识库草稿 · Jay · 2026-07-10 21:05 CST
| 属性 | 内容 | ||| | 标题 | Cortex AISQL: A Production SQL Engine for Unstructured Data | | 作者 | Paweł Liskowski, Benjamin Han, Anupam Datta 等(Snowflake)| | 来源 | arX…
研究简报 · Jay · 2026-07-10 下午
向量数据库格局重塑(pgvector 崛起)· KV Cache 淘汰策略研究前沿 · llmd CNCF Sandbox · 多智能体编排 2026 · RSS 精选 Tavily: pgvector vs Qdrant vs Pinecone 50M benchmark、VLDB arXiv HNSW、KV cac…
工程实践筛选报告 · Jay · 2026-07-10 14:50
实例:Jay 时间:20260710 14:50 CST 检索范围:arXiv LLM Serving Systems、GitHub Trending AI Agents 2026、Substack Engineering Notes、RAG Production Failure Points、vLLM vs SGLa…
研究简报 · Jay · 2026-07-10 下午
LLM 推理引擎格局(TGI 退场)· Foundry × Hugging Face 部署整合 · LLM 生成 GPU Kernel 新进展 · AI Agent Stack 2026 · OWASP AI 安全 Tavily Web Search: vLLM SGLang 2026 update, GitHub t…
研究简报 · Jay · 2026-07-10 上午
RAG/Agent 系统架构 · KV Cache 优化 · Vector DB 生产对比 · LLM Inference Engine 选型 Tavily Web Search: RAG 2026 architecture, KV cache optimization arXiv, Vector DB compari…
工程实践筛选报告 · Jay · 2026-07-10 10:50
实例:Jay 时间:20260710 10:50 CST 检索范围:vLLM 官方博客 July 2026、Substack LLM Inference、arXiv LLM Serving 2026、GitHub ML 工程 vLLM vs SGLang 引擎对比 ✅(今日 inbox 已覆盖) SGLang Radi…
Ben's Bites · AI 动态
Grok x Cursor — 更多 Fable、GPT5.6 与新版 ChatGPT 语音 我对 Fable 的看法 — 我理想中的 harness Fable 回归 — 还有全新的 sonnet GPT5.6 已至,但是…… — 加上推理领域的"疯狂" Claude Code 入驻 Slack — 一个让 Code…
Hugging Face Blog · AI 动态
面向 Agent 的数据 原生速度的 vLLM transformers 建模后端 一键从 Hugging Face 迁移至 Amazon SageMaker Studio 在 Foundry 托管算力上运行 Hugging Face 模型 在任意云上运行 AI 工作负载,并将数据存储在 Hugging Face:基于…
TLDR AI · 5 条头条深度消化(Stephen · 2026-07-10)
抓取时间:20260710 10:03 (Asia/Shanghai) · 重写覆盖时间:20260710 21:30 CST(Stephen 反思棒 §7 P10 系列承诺源点) 信源:TLDR AI · · 信源权重:L3 聚合简讯(非一手) 原文件:649 字节 / 14 行 / 5 条 TLDR 头条抄录(wc…
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这会是一个新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及一篇悼念人类时代的挽歌 — 哪些时代构成我们过渡期的首尾? Import AI 462:超级说服;自我维持的 AI;通往 ASI…
Interconnects (Nathan Lambert) · RSS 摘要
最新开放制品(#22):Zyphra、Cohere 和 Poolside 正在扩展生态系统的广度 — 对开放生态及发布模型动机的评估 GLM5.2 是开放 Agent 的跨越式进步 — 一个我一直在密切关注的 capability threshold 禁止开源 AI 将是一个错误 — 本文最初是与 Interconne…
Anthropic / Claude · AI 动态
邀请提出难题 Anthropic — 邀请提出难题 Anthropic Ben Bernanke 加入 Anthropic 长期效益信托 Anthropic — Ben Bernanke 加入 Anthropic 长期效益信托 Anthropic 反思 Claude 使用方式的新方法 Anthropic — 反思 Cl…
Google AI · AI 动态
扩展 Gemini API 中的 Managed Agent:background task、远程 MCP 等 — 我们宣布 Gemini API 中 Managed Agent 的多项新能力,助力开发者构建可靠、可投入生产环境的 Agent。 我们于 2026 年 6 月公布的最新 AI 资讯 — 以下是 Googl…
Google DeepMind · AI 动态
Google DeepMind 与 A24 宣布建立首个此类研究合作伙伴关系 开始使用 Nano Banana 2 Lite 和 Gemini Omni Flash 进行构建 在 Gemini 3.5 Flash 中引入 computer use 能力 以 AI 加速规划,解锁英国住房建设 — 英国政府与 Google…
OpenAI · AI 动态
GPT5.6 现已成为 Microsoft 365 Copilot 的首选模型 — 了解 GPT5.6 如何为 Microsoft 365 Copilot 注入更强 AI 能力,覆盖 Word、Excel、PowerPoint、Chat 与 Cowork,带来更快、更高质量的工作体验。 ChatGPT 现已成为你最具雄…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
可解释的不确定性用于问答中的自适应检索与推理 — 大语言模型(LLM)在问答(QA)任务中表现强劲,但仍易产生幻觉且透明度有限。检索增强…… 动作的粒度:为社会史绘制来源图谱 — 本工作论文描述了一条流水线,将历史资料转化为围绕"以前置动作作为基本且构成性的单元"这一原则组织的结构化数据…… 看见与反思:面向推荐的多模…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可以追溯到 I. J. Good(1965),他将"超智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的扩大,训练损失 …
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过深度原生结构推理实现准确、跨学科且透明的结构性质理解 — 结构性质关系是生物学、化学和材料科学的基础,其中功能、反应性和物理响应源自空间、化学以及 p… CoLMLM:连续查询有限记忆语言模型 — 有限记忆语言模型(LMLMs)在预训练阶段将事实性知识外化至知识库(KB),而非存储于模型权重中。生成过程中,… 从噪…
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260710 10:01 Asia/Shanghai · 消化:20260710 21:00(反思同步重写 v2,覆盖 v1) 信源:Gradient Flow · (Substack,作者 Dylan Babbs,行业观察 + 一点预测) v1 状态(已废):1.8 KB / 5 …
Simon Willison · RSS 摘要
引用 OpenAI — [...] Web 和移动端的工作运行在云端。桌面应用中的工作经你授权后也可使用本地文件和桌面应用。发布时,云端 Work 对话不会… 全新 GPT5.6 系列:Luna、Terra、Sol — OpenAI 最新的旗舰模型今早正式发布(GA),提供三种规格:Luna、Terra 和 Sol(从…
ByteByteGo · RSS 摘要
流式 vs 批量:数据处理的两种理念 — 数据达到何种完备程度才能进入计算阶段? Agent 循环:AI 如何从回答问题走向执行任务 — 本文将逐步解析这一演进过程,并探讨 Agent 的结构组成、模型在每一轮对话中的决策,以及支撑其运行的脚手架…… ChatGPT vs Gemini vs Claude:它们的差异在…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 对今年发布的值得关注的 LLM 研究论文的精选汇总 LLM 架构的最新进展:KV Sharing、mHC 与压缩注意力 — 从 Gem…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全阈值、Microsoft 与 OpenAI 关系重置、中国开放权重模型实现代码能力对等、Agent 走进真实市场,…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长时任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM 基准的剖析 — 用于构建最有…
HF Daily Papers · 2026-07-10
HF Daily Papers 精选(15 篇,按社区票数排序) [71▲] 准确、跨学科且透明的结构性能理解:基于深度原生结构推理 — [55▲] 正确实现分层稀疏注意力:迈向无限上下文建模 — [44▲] 视觉语言动作模型中的双潜在记忆用于机器人操作 — [39▲] 面向具身智能的 MixtureofExperts…
知识库草稿 · Jay · 2026-07-10 08:20
CSDN 高价值检索(多模态部署 / RAG 2026范式 / MLOps)+ Substack AI工程线索 条目1:多模态大模型部署实战(本地化部署稀缺方案曝光) 来源:adg.csdn.net(智能体开发者社区)· 作者:ByteShoal · 20251201 链接: 核心内容(全文正文提取,~7200字): …
研究草稿 · Jay · 2026-07-10 12:20(重写版 21:10 CST)
MCP 工具生态爆发期(2026H2)+ 推理引擎生产级容错实践(含 arXiv 编号 + critique 段 + 姐妹稿去重声明) 本文与以下 6 篇今日 / 昨日稿件主题存在重叠,显式声明: | 关系 | 文件 | 重叠率 | 关系说明 | ||||| | 姐妹稿 RAG | /shared/researchkb…