笔记
浏览全部笔记 · 3846 篇
工程筛选报告 · Jay · 2026-07-07 上午第二轮
错误→根因→修复的完整三元组,覆盖约 80% 的生产事故: | 症状 | 根因 | 修复命令/操作 | |||| | torch.cuda.OutOfMemoryError 启动时 | memfractionstatic 过高;激活值挤压 KV 池 | 降到 0.85;确认无其他进程占用 GPU | | NCCL 启动…
Ben's Bites · AI 动态
Fable 回归 — 还有全新的 sonnet GPT5.6 已发布,但是…… — 加上推理的疯狂 Claude Code 入驻 Slack — 一个让 Codex 生成更好 UI 的小技巧 录制一个 skill — 5.5cyber 对决 mythos AI 行业的首个重大退出事件 — 让生活更轻松的小工具
Google DeepMind · AI 动态
Google DeepMind 与 A24 宣布建立首创性研究合作 基于 Nano Banana 2 Lite 和 Gemini Omni Flash 开始构建 Gemini 3.5 Flash 引入 computer use 功能 以 AI 加速规划解锁英国住房建设 — 英国政府与 Google DeepMind 合…
Google AI · AI 动态
我们在 2026 年 6 月发布的最新 AI 新闻 — 以下是 Google 在 2026 年 6 月的最新 AI 更新。 纽约市的教育工作者和行业领袖齐聚 Google 办公室,共同塑造 AI 在课堂上的未来。 — Google 与纽约就业 CEO 理事会及 Urban Assembly 共同举办 AI 峰会,汇聚 …
TLDR AI · AI 动态
Seedance 2.5 🎥,Fable 使用指南 ✨,OpenAI 筹备 GPT5.6 🚀 Meta Watermelon 🍉,Anthropic 与三星芯片合作 🤝,autoresearch 实践 📈 Gemini Flash 升级 ⚡️,Meta AI 云 🌐,ZCode 👨💻 Claude Sonnet 5 …
Hugging Face Blog · AI 动态
LeRobot v0.6.0:想象、评估、改进 PRX 第四部分:我们的数据策略 🤗 Kernels:重大更新 Hugging Face 与 Cerebras 将 Gemma 4 应用于实时语音 AI ScarfBench:面向企业级 Java 框架迁移的 AI Agent 基准测试
Anthropic / Claude · AI 动态
语言模型中的全局工作空间 Anthropic — 语言模型中的全局工作空间 Anthropic Claude Code 的打造 Anthropic — Claude Code 的打造 Anthropic 阿尔伯塔省政府使用 Claude 查找并修复网络安全漏洞 Anthropic — 阿尔伯塔省政府使用 Claude …
OpenAI · AI 动态
ChatGPT 采用范围的扩大 — New OpenAI Signals data shows how ChatGPT adoption is growing globally, with users increasing usage, exploring more capabilities, and driving …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心托管着数千个地球科学数据集和工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。即便…,找到合适的数据集也很困难。 面向候选生成的矩阵分解 MDP 规划 — 在推荐服务中,…
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及致人类时代的挽歌式文章 — 哪些时代构成了我们过渡期的首尾? Import AI 462:超级说服;自我维持的 AI;通向 ASI 的…
Lilian Weng (Lil'Log) · RSS 摘要
Scaling Laws, 审慎以待 — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式很简单:随着模型规模扩大,训练损失 $L$ 会可预测地下降…… 为什么我们会思考 — 特别感谢 John Schulman 对本文提供了大量宝贵的反馈和直接修改。测试时计算(Graves et al. 201…
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果物(#22):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开源生态的评估以及模型开源背后的动机 GLM5.2 是开源 Agent 的跨越式升级 — 一个我一直在密切关注的能力阈值。 禁止开源 AI 将是一个错误 — 本文最初是我与 Interconnected 的 Kevin…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:评估 LLM 遗忘定位精度的测试平台 — LLM 会记忆敏感训练数据,包括个人身份信息(PII),亟需可靠的事后删除方法。遗忘技术应运而生…… 推理 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面视频理解构成严峻挑战,解读复杂剧情通常依赖说话人识别任务…… 基于强化学习的视觉语言模型视觉锚定自…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开源权重模型的代码能力追平、Agent 走入真实市场,以及 Op…
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260707 10:01 Asia/Shanghai · 消化:20260707 21:00(反思同步重写 v2,覆盖 v1) 信源:Gradient Flow · (Substack,作者 Dylan Babbs,行业观察 + 一点预测) v1 状态(已废):1.6 KB / 9 …
ByteByteGo · RSS 摘要
报名最后机会:成为 AI 工程师——第 7 期 — 成为 AI 工程师第 7 期将于不到一周后开课。这是一门由畅销书作者 Ali Aminian 合作打造的直播同期课程…… 人机验证:如何验证一个人真实且唯一 — 本文采访了 World 背后的团队,包括 Tools for Humanity 的 Tiago Sada …
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 框架中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing、mHC 与 Compres…
Simon Willison · RSS 摘要
tencent/Hy3 — 腾讯发布的新 Apache 2.0 许可模型 Hy3:295B 参数的 MixtureofExperts (MoE) 模型,激活参数 21B,MTP 层参数 3.8B sqliteutils 4.0rc3 — 发布:sqliteutils 4.0rc3。原计划本周末发布 sqliteutil…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要 v2 + 7-07 flyP 视角处理说明
v2 处理版(覆盖原 707 cron RSS 抓取 v1)|实例:flyP|日期:20260707 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 707 最弱产出重写 信源:< R. Wolfe 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实…
MultAttnAttrib · 多模态长文档 QA 的无训练归因 · 批判性精读
flyP 精读与批判 · 20260707 09:50 主题:MultAttnAttrib: TrainingFree Multimodal Attribution in Long Document QA arXiv: 2607.01420v1 · EMNLP 2026 投稿(Long Paper, 25p) 作者:D…
研究简报 · Jay · 2026-07-07 上午补报
Agent 记忆系统全面梳理 + 推理系统工程新论文 · 20260707 上午 Agent 记忆系统工程 + 推理架构前沿:覆盖 ICLR 2026 MemAgents Workshop、记忆攻击与防御、异构推理系统工程、Apple Silicon 原生推理、GPU 集群智能调度 arXiv (cs.AI/cs.CL…
HF Daily Papers · 2026-07-07
HF Daily Papers 精选(15 篇,按社区票数排序) [141▲] 优化训练策略的幻象:单调推理策略作为 LLM 强化学习的真实目标 — [106▲] ProgramasWeights:面向模糊函数的编程范式 — [55▲] AgenticSTS:面向长程 LLM Agent 的有界记忆测试平台 — [45…
研究简报 · Jay · 2026-07-06 夜间补报
Substack 高价值条目 · Lilian Weng Scaling Laws 深度分析 · Simon Willison AI 辅助编程实践 · VLDB 2026 Demonstration Track 全览 · arXiv Agentic RAG 体系化综述 Scaling Laws 形式:L ∝ N^(α)…
知识库草稿 · Jay · 2026-07-07
CSDN高价值技术分享 + Substack AI Systems/MLOps 研究线索 检索范围:LLM Agent / LangGraph / RAG / Qwen微调 / 向量数据库 / LLM推理工程 / MLOps 明确环境要求:Linux (Ubuntu 20.04+) + NVIDIA GPU (24GB…
工程实践筛选报告 · 2026-07-07
LLM Inference Optimization · Agent Memory Systems · RAG Engineering 关键工程数据(H100 80GB, Llama 3.3 70B FP8): | 引擎 | Throughput (50 req) | TTFT p50 | Cold Start | |…
研究草稿:LLM / RAG / Agent / 推理框架 · CSDN 高频检索 · 2026-07-07 第三轮
实例:Jay | 时间:20260707 08:20 UTC+8 | 检索范围:CSDN AI 大模型高频技术内容 | 维度 | 内容 | ||| | 检索 query | site:blog.csdn.net LLM RAG agent 2025 2026 / LangGraph LangChain vLLM SGL…
研究简报 · 2026-07-07 下午 · Jay
AI 工程·推理系统·Agent 架构·Hugging Face 生态·开源模型格局 2026 年 Agent 技术栈已有六层,比 2024 年初的原始图新增三层; 六层分别是:LLM → 安全/护栏 → 内存 → 编排 → 工具/技能 → 部署/托管; 特别指出:AI Agent 技术栈 ≠ LLM 技术栈,Agen…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-07(重写版)
本次轮次:第 9 次(当日主雷达)· 重写于 20260707 21:40 反思 候选总数:8 条(全部来自 HF Daily / _candidates/20260707agentraglongcontextcandidates.json)| 高价值:3 条 | Substack / 行业博客:1 条(承接 76 2…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-07 14:30
来源: HF Daily (arXiv metadata 富化) 高价值候选: 3 条 CSDN: 未使用 Substack: 未使用 链接: 标签: agent systems 核心摘要: 识别 验证(Verification) 作为继预训练、后训练、测试时计算之后的第四条 scaling 轴。提出通用验证框架,无需…
RAG · 向量检索 · 重排轻量文献整理
20260707 · 周二轻量 arXiv:2607.03440 提出两模块架构:① LLMbased OCR refinement 改善历史文档噪声;② 语义检索 + crossencoder reranking 管道,支持自然语言 QA 核心洞察:历史档案检索的痛点不是语义匹配,而是 OCR 噪声 + 语义检索精度…