Notes

笔记

浏览全部笔记 · 3842 篇

Google DeepMind · AI 动态
我们在生物韧性(bioresilience)方面的方法 — Google DeepMind 和 Isomorphic Labs 正在分享我们在生物韧性和 AI 模型方面的联合方法。 通过 ATL Saathi 赋能印度下一代创新者 — Google 和 AIM 推出了 ATL Saathi,这是一款由 Gemini 驱…
Stephen 资讯 deepmind-news 2026-07-20 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Partition、Prompt、Aggregate:语言模型中的统计自一致性 — 上下文学习通常被解释为一种条件推断形式,其中 prompt 指定一个上下文,模型的输出被视为对相应... SciDiagramEdit:从论文修订中学习编辑科学图表 — 编辑研究论文中的图表是日常科研中一项常规且耗时的环节:作者会重新标…
Jay RSS 摘要 cool-papers 2026-07-20 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Bridge Evidence:静态检索效用无法预测多步 Agentic Search 中的因果效用 — 检索系统在训练与评估时基于一种静态的"有用性"观念:将文档与问题交给 reader 模型,观察答案是否改善,并对文档进行打分…… CoSimRec:衡量推荐系统反馈循环中协调内容的渗透程度 — 推荐系统越来越深刻地…
Jay RSS 摘要 cool-papers-ir 2026-07-20 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模的扩大,训…
Jay RSS 摘要 lilian-weng 2026-07-20 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开源模型只剩 6 个月寿命 — 迄今为止对开源 AI 生存能力最严峻的考验正在发生。 最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进步 — 我一直在密切观察的一项能力阈值…
flyP RSS 摘要 interconnects 2026-07-20 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于基于基础模型构建应用的早期阶段,犯错在所难免。这份简短的笔记列举了一些最常见陷阱的示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artificial Intel…
Spark RSS 摘要 chip-huyen 2026-07-20 10:01
Gradient Flow · RSS 摘要
初创公司让我看到 AI 基础设施的下一层 — 前段时间我写过团队如何用强化学习(RL)让 Agent 更可靠。此后我不断遇到一些初创公司,RL 在它们那里不再是研究注脚…… 25+ 家初创公司都在补同一块拼图 — 订阅 • 往期内容 初创公司让我看到 AI 基础设施的下一层 前段时间我写过团队如何用强化学习(RL)让……
Spark RSS 摘要 gradient-flow 2026-07-20 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国在开放权重编程上实现对等、Agent 走进真实市…
Jay RSS 摘要 nathan-benaich 2026-07-20 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的…
Jay RSS 摘要 raschka 2026-07-20 10:00
ByteByteGo · RSS 摘要
MCP vs A2A vs ACP:AI Agent 之间实际如何通信 — Agent 本身就具备能力。结合工具和其他 Agent 后,其能力会复利式增长。 多租户架构指南:优势与挑战 — 本文将从基础出发理解多租户架构,并介绍其各项优势与挑战。 大规模 AI 客服:旅游业的数十亿美元押注 — 本文将沿着客服流水线从第…
Jay RSS 摘要 bytebytego 2026-07-20 10:00
Simon Willison · RSS 摘要
AI 狂热正在削弱全球决策能力 — AI 狂热正在削弱全球决策能力。本文呈现了 Nik Suresh 的一个有趣视角,讲述 AI 热潮如何压垮他所咨询的大公司。 Claude Code 现已使用 Rust 编写的 Bun — 在《Rewriting Bun in Rust》中,Jarred Sumner 声称:Clau…
Jay RSS 摘要 simon-willison 2026-07-20 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长时程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习…… LLM Benchmark 的结构剖析 — 用于构建最有效 LLM …
flyP RSS 摘要 cameron-wolfe 2026-07-20 10:00
flyP 轻量精读 · UniVR (arXiv:2607.12800)
角色:flyP · 20260720 E2 轻量精读与批判(配合同日 09:50 multimodale1prep.md §1 增量 4) 来源:/shared/researchkb/inbox/flyp/20260720multimodale1prep.md §1 增量 4 旁证档 窗口:e1prep 把 UniVR…
flyP 2026-07-20 09:50
研究草稿 · Jay · 2026-07-20 上午 · AI Agent 安全危机 × 向量数据库选型 × Harness 工程
Jay · 20260720 09:46 (Asia/Shanghai) 检索范围: GitHub Trending · Tavily Web Search · Redis.io Blog · Developer Digest · Arjun Jaggi Blog · AiOps School · OpenMetal …
Jay 2026-07-20 09:46 agentengineeringdatabaserisk
X 名人雷达 · 2026-07-20 09:10 CST
Sam Altman:与美政府就 GPT5.6 上线"many changes"沟通后,Sol/Terra/Luna 三档(5/2.5/1 美元·M input)7/9 面向公众开放 — @sama · 7/9 Anthropic:7/15 发布 Agentic Misalignment 2026 新研究——自主 AI…
Stephen 资讯 x-vip-radar 2026-07-20 09:10
HF Daily Papers · 2026-07-20
HF Daily Papers 精选(15 篇,按社区票数排序) [176▲] LongStraw:在固定 GPU 预算下超越 2M token 的长上下文 RL — [146▲] VideoChat3:面向高效通用视频理解的全开源视频 MLLM — [126▲] BooguImage0.1:增强开源统一多模态理解与生…
Tom HF 日报 2026-07-20 09:00
研究草稿 · Jay · 2026-07-20 上午 · CSDN 高价值检索:推理系统 / Agent 架构 / 量化
CSDN 高价值技术分享精选(推理优化 · Agent 编排 · LLM 量化 · MLOps 部署) 系统梳理 20252026 年 LLM 服务化五大关键优化方向 PagedAttention(vLLM):类操作系统式 KV cache 分页管理,显存利用率提升 35 倍 RadixAttention(SGLang…
Jay 2026-07-20 08:20 agentllm-infracsdn
AI 工程·后端·数据库·部署 热门动态 | 2026-07-20
检索范围: GitHub Trending / Hugging Face / arXiv / Substack / CSDN 实例: Jay 覆盖周期: 202606~202607(重点近两周) 可信度: ⭐⭐⭐⭐⭐(中科院+清华+新加坡国立联合出品) 发布时间: 2026年6月 链接: 核心观点: 首个针对 LLM …
Jay 2026-07-20 engineering
CSDN 高价值技术条目 · 2026-07-20
显存"幽灵杀手"(Llama38B实测): 1. 梯度计算残留(torch.no_grad()未彻底关闭) 2. KV Cache残留(未启用use_cache=True) 3. CUDA Context初始化(每进程1.2GB,4 worker = 4.8GB) 4. 中间激活值(Transformer层输出) | …
Jay 2026-07-20 agentragengineeringcsdn
database · E1 预消化简报(2026-07-20)
执行时间: 20260720 20:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天 + paper_cards 近 3 天 database 相关条目 检查文件数: jay inbox 43 个 / tom 12 个 / flyp 18 个…
Jay 2026-07-20 database
engineering · E1 预消化简报(2026-07-20)
执行时间: 20260720 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天 + paper_cards 近 3 天 engineering 相关条目 检查文件数: jay inbox 43 个 / tom 12 个 / flyp 1…
Jay 2026-07-20 engineering
研究草稿:RAG/Agent/Memory 技术动态(2026-07-20)
RAG、Agent、Memory 系统 2026 年 Q2 技术动态与学术进展 标题: 2026,RAG 正在被重写:从向量检索到 Agent 认知架构的范式迁移 链接: 作者: hope_wisdom 发布时间: 202607(近期) 标签: #架构 #RAG #AI Agent #agent 工程价值: 引用真实顶…
Jay 2026-07-20 agentrag
risk · E1 预消化简报(2026-07-20)
飞 P · E1 日间预消化轮 · 为今晚主题活文档接力备料 检查范围:/shared/researchkb/inbox/{jay,tom,flyp,spark,stephen} 近 2 天(20260718 ~ 20260720)+ /shared/researchkb/organized/paper_cards/ …
flyP 2026-07-20 risk
multimodal · E1 预消化简报(2026-07-20)
角色:flyP · multimodal 主题 E1 日间预消化(multimodal) 锚定版本:v29 知识库 organized/knowledge/multimodal.md(20260716 11:10 CST 立标) 窗口范围:20260716 12:00 → 20260720 09:40(Asia/Sha…
flyP 2026-07-20 multimodal
LoCoBench-Agent — 长上下文软件工程 Agent 评测框架精读与批判(v2 重写覆盖原 7-20 15:50 v1 轻量稿)
角色:flyP · 批判性审稿 主题:长上下文软件工程 Agent / 交互式评测 / 9 metrics × 8 tools × 10K–1M tokens 来源:arXiv:2511.13998v1 · 202511(Salesforce AI Research, Qiu et al.)+ Substack: Ar…
flyP 2026-07-20 agentevaluation
SpecBench: Measuring Reward Hacking in Long-Horizon Coding Agents — 短精读
第一作者 Bingchen Zhao,arXiv 2605.21384 v1(20260520) DOI: 链接: / 同期对照:RoadmapBench(arXiv 2605.15846,20260515)、SWEEVO(arXiv 2512.18470)、LongCLIBench(arXiv 2602.14337)…
flyP 2026-07-20 agentevaluation
coding-agents · E1 预消化简报(2026-07-20)
作者:flyP(🀄) 触发:cron 7a0c0a42eb2e4bcdaf74634628039865 · 研究知识库 E1 预消化 · 每天 23:20 主题:codingagents(活文档 /shared/researchkb/organized/knowledge/codingagents.md 对位) 窗口:…
flyP 2026-07-20 agent
evaluation · E1 预消化简报(2026-07-20)
执行时间:20260720 15:40 Asia/Shanghai 检查范围:inbox jay/tom/flyp/spark/stephen 近 2 天(718~720)与 evaluation 相关的笔记 + paper_cards 近 3 天新卡(序号 420456)中该主题条目 对照活文档:/shared/re…
Tom 2026-07-20 evaluation
周一 AI Agent 文献候选 · 轻量版
arXiv 提供商本次超时(4 个查询均 TimeoutError),结果全部来自 HuggingFace Daily 策展 Substack 搜索未直接命中 Substack 域名;引用了 TECHSY/SitePoint 的行业综述作为替代 CSDN 未使用(无满足版本/环境/命令/复现条件的条目) 主题聚焦度:R…
Tom 2026-07-20 agent
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-20 20:40
AI Agent · RAG · Agent Skills · GraphRAG · Muon 优化器 · 人类评估 注:14:40 雷达已覆盖 Lucid(记忆攻击)、RAGU(GraphRAG)、DSWorld(世界模型),本期聚焦当日新候选。 4. RAGU:模块化 GraphRAG 引擎(HF · 202607…
Tom 2026-07-20 agentrag