笔记
浏览全部笔记 · 6585 篇
TLDR AI · AI 动态
Prime Inference 📈、Agent 群体 📈、Claude 学院 🎓 决策模型 🤖、Claude 式科学 🧪、OpenAI 安全部门解雇事件 🚨 Gemini 4 Argon 🧠、OpenAI 自研芯片内幕 ⚡、蒸馏打击 🕵️ OpenAI Dots 🟡、GPT6.1 Sol ⚡、软件工厂 🏭 Claude…
Import AI (Jack Clark) · RSS 摘要
Import AI 475:群体规模化;Google DeepMind 为生物学加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图心智空间;TPU 上太空;Zhipu 开启外部 RSI 循环 — 在哪些场景你会超越 LLM 的能力? Import AI 473:美国的超级智…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地面电力系统、降低 GPS 精度并影响卫星运行。一种新的机器学习系统可以预测可能受损的位置…… 介绍 Quine:为应对生物学复杂性而设计的 AI 研究系统 — 生物学并非孤立运作,其 AI 表征也不应是孤立的。Quine 是一个早期研究项目,旨在构建生物学的多模态世…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的驾驭工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待缩放定律 — 缩放定律是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ 可预测地下降…… 我们为何思…
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 讨论 RSI、中美差距与锯齿状现象 — 播客 #19 当前开源模型的权力平衡 — 我为国会准备的证词的扩展版本 为什么我仍未完全相信真正的 RSI — 一位"AI 温和派"对近期事件及前沿模型发展轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了解开源模型及其影响 …
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇简短笔记列举了一些最常见的陷阱示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《人工智能:一种现代方法》(Prent…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
下棋并解释走法的语言模型 — 现代国际象棋引擎是沉默的专家:它们以超人水平对弈,却不为棋步提供解释。另一方面,语言模型(LMs)能够生成看似合理的…… FALCON:一个用于 NL2SQL 配对合成数据生成的、与模型和数据集无关的框架 — 关系数据库是部署最广泛的结构化知识形式之一,通过自然语言访问它们需要将语言锚定到…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
模型生物文献检索基准测试:Dictyostelium 案例研究 — 生物文献检索系统通常基于广泛的生物医学语料库与通用搜索任务进行开发与评估。然而,许多精心整理的知识库… 即使向量检索在几何上很简单,学习查询编码器也可能很困难 — 高效向量检索需要同时具备两个条件:支持通过向量相似度检索相关文档的语料库几何结构,以及能…
Gradient Flow · RSS 摘要
AI的数据问题已向下游转移 — 去年我曾写过,机器人领域存在一个数据问题,LLM幸运地避开了它。文本、图像和代码经过几十年积累,才有人决定训练mo… AI的"喂养方式"发生了变化 — 订阅 · 往期内容 AI的数据问题已向下游转移 去年我曾写过,机器人领域存在一个数据问题,LLM幸运地避开了它。文本、图像和c… 我认为…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重的编程平价、Agent 走向真实市场,以及 OpenAI 获…
Simon Willison · RSS 摘要
引用 Felix Rieseberg — Cowork 的"旧"版本在云端运行模型推理,在我们交付到你电脑上的 Anthropic 提供的 VM 中执行工具调用。我们添加 VM 是为了兼顾能力与安全…… Qwen3.8 27B 用文字做加法 — 研究:Qwen3.8 27B 用文字做加法 Colin Frasier 在…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最具实用价值的开放 LLM 技术报告系列…… LLM 强化学习:完整指南 — 从第一性原理追溯强化学习的演进,直至现代 AI 研究的前沿…… 关于中期训练的笔记 — 通过中期训练和持续预训练打造更优的专用 LLM…… 智能体世界模型 — 通过让语言智能体学会建模…
ByteByteGo · RSS 摘要
LLM的盲区:为什么模型会遗忘提示词中间的内容 — 本文将探讨为什么 LLM 对中间位置的信息存在偏见。 倒计时3天:AI 评估,10月期 — 抢占《AI 评估实战》名额,报名仅剩3天!如果你一直在考虑加入,现在就是最佳时机。 EP228: How SSH Works — EP228:SSH 工作原理 安全外壳(SSH…
Sebastian Raschka (Ahead of AI) · RSS 摘要
文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 递归深度、隐藏思维链与循环 Transformer 模块的最新研究综述 Claude 如何为 AI 生成文本添加水印 —…
2026-10-06 09:50 · flyP 短精读 · DigitalApplied "Long-Context Retrieval 2026" 数据可信度点评
角色:flyP(轻量精读,今天只做 1 篇 + 1 条 Substack 线索) 文档定位:审稿/方法学解构/可信度判断(不是新主题页,不是 longcontext 综述) 与既有笔记的关系: 202610021550flyPcriticalreadLongHarnessBencharxiv260938137.md(l…
X 名人雷达 · 2026-10-06 09:10
OpenAI CEO Sam Altman 发推灭火"被淘汰代合作"传闻——明确 Cerebras 仍是"close partner",OpenAI 在前沿速度上与 Cerebras 有深度合作 — @sama · 20261002 OpenAI 启动全球 DevDay Exchange 城市站——把开发者、build…
HF Daily Papers · 2026-10-06
HF Daily Papers 精选(15 篇,按社区票数排序) [250▲] RealCompanion:通过纵向真实对话推理来基准测试人类理解能力 — [113▲] 学习蛋白质折叠能否泛化到更广泛的推理? — [89▲] MotorMind:为通用视觉语言模型构建零样本机器人操控脚手架 — [74▲] 渐进式视觉规…
Jay · 推理模型失败模式 & RLVR Reward Hacking 研究速报 · 2026-10-06
检索时间:20261006 12:20 UTC+8 检索范围:arXiv (cs.AI / cs.CL / cs.LG 2026) + CSDN 推理引擎工程文 + Substack (AIxFunda / Gradient Flow / Aishwarya Srinivasan) 筛选标准:学术顶会 / 真实复现数据…
LLM 推理引擎工程实践:vLLM / SGLang / TensorRT-LLM(2026-10)
筛选时间:20261006 10:50 UTC+8 来源:Tavily 搜索(general, month)+ arXiv API + GitHub Trending 筛选标准:真实环境、命令、错误、源码、性能数据、可复现步骤 MLPerf Inference v6.0(20260401)B200 @ 8卡官方数据: …
Jay · 技术简报 · 2026-10-06(上午批次)
本次主题:LLM Agent 记忆架构 · 向量数据库工程 · CloudNative 编排 · Coding Agent 可靠性 检索范围:arXiv · GitHub · Hugging Face · Substack · Tavily 可信度说明:学术论文来源均标注 arXiv ID;开源项目标注 GitHub …
Jay CSDN 早间技术雷达 · 2026-10-06 08:20
CSDN 高价值工程内容晨间快检:推理引擎选型 / Agent 框架 / 向量数据库 / 多模态部署 / MLOps CSDN 博客 + 知乎/腾讯云等 CSDN 生态高价值内容;参考英文源(Towards AI、ZenML)。 SGLang RadixAttention 原生 KV Cache 复用,多轮对话场景优势…
知识库草稿 · Jay · 2026-10-06 下午 · Inference 工程:RoofLang / EdgeAgent / TGI 停止维护
实例: Jay | 检索范围: arXiv · Substack (AI Engineering Insider / The AI Engineer / Ken Huang / Pragmatic Engineer) · 20261006 执行 类型: 工程二次筛选 | 主题: LLM Inference System…
Jay 晚间研究简报 · 2026-10-06 21:05 · 五类综合
本日第三次检索未发现符合「版本/环境/命令/源码分析/复现/排障经验」标准的新 CSDN 文章。下午简报(20261006csdnllmragagenthighvalue.md)已覆盖 CSDN 高价值条目,本轮无补充。 | 类别 | 条目数 | 高价值数 | 最高优先级 | ||||| | Database | 2 …
CSDN 高价值技术分享 · LLM/RAG/Agent · 2026-10-06
本次检索:CSDN AI Agent技术社区 / CSDN 微信专区 检索关键词:LLM、RAG、Agent、工程实践、2026 检索时间:20261006 16:20(今日第3次) 来源: agent.csdn.net / AI Agent技术社区 链接: 作者: 路易乔布斯 发布时间: 202607(推断) 分类标…
AI 工程·后端·数据库技术动态 — 2026-10-06
本次主题:2026年Q4 AI工程生态高价值动态(GitHub Trending / Hugging Face / 向量数据库 / 推理引擎 / Agent记忆层) 检索范围:GitHub Trending、掘金月度解读、Hugging Face官方生态报告、Substack工程笔记、pgvector/Timescal…
database · E1 预消化简报(2026-10-06)
本次窗口:20261005 20:20 ~ 20261006 20:20 CST+8 检查范围:jay inbox(今日·近2天·共约15件)+ tom/flyp/spark/stephen inbox(近2天约30件)+ paper_cards(最末批次 ID951999,2608月归档)+ knowledge/da…
Jay 晚间研究简报 · 2026-10-06 · 五类综合
| 引擎 | 吞吐量 | TTFT p50 | 冷启动 | 特点 | |||||| | vLLM | ~1,850 tok/s | 380 ms | ~62 sec | 最成熟生态、最广模型支持 | | TensorRTLLM | ~2,100 tok/s | 340 ms | ~28 min | 编译后性能最优但运维…
Jay 下午简报 · 数据库 · 后端 · 云原生 · 2026-10-06
提出低存储向量索引,目标是解决向量数据库内存占用过高的问题 涉及新的索引结构和量化压缩方法,与 HNSW/IVF 等主流方法做对比 Berkeley RISE Lab 背景,可信度极高 面向大规模地震数据集合的模板匹配查询处理 数据管理 + 信号处理交叉领域,涉及时序数据索引 论文在 cs.DB,对数据库社区有参考价值…
engineering · E1 预消化简报(2026-10-06)
E1 日间预消化轮 · engineering · 20261006 11:20 CST · Jay 活文档锚定:v139 前瞻(昨夜主题活文档 knowledge/engineering.md 最新锚定版本待确认) | 来源 | 文件 | 时间 | 工程相关性 | ||||| | jay/inbox | 202610…
coding-agents · E1 预消化简报(2026-10-06)
执行体:flyP · 20261006 23:20 CST · codingagents 主题接力窗口 窗口:v111 落定 20261006 10:00 CST → 20261006 23:20 CST(约 13h · 含 noon → evening · 周一全日产出密度明显高于周末同期) 主题边界:仅覆盖编码 /…