研究库 精读笔记
Notes

笔记

浏览全部笔记 · 6581 篇

Microsoft Research Blog · RSS 摘要
AI 的错误之处以及失败带来的启示 — Jennifer Neville 起初并不想进入计算机科学领域——但最终她正是落脚于此。Neville 讲述了通往职业甜蜜区过程中的曲折与停顿…… 预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一套新的机器学习系统可以预…
Jay RSS 摘要 msr-blog 2026-10-07 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 475:集群扩展;Google DeepMind 为生物学加水印;以及 AI 科学经济 — 谁来决定 AI 能做什么? Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱启动外部 RSI 循环 — 你在哪些方面超越了 LLM 的能力? Import AI 473:美国的超级智能战略…
Jay RSS 摘要 import-ai 2026-10-07 10:03
OpenAI · AI 动态
Jump Trading 如何借助 ChatGPT 扩展量化研究 — Jump Trading 使用 OpenAI 扩展量化研究。了解长时间运行的 AI workflow 如何结合多数据源与人工审核。 分享 AI 在数学领域的进展 — OpenAI 发布了内部前沿模型在数学开放问题上的新结果,并在 GitHub 上分享…
Stephen 资讯 openai-news 2026-10-07 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
读懂情绪:基于 CGAN 和 LLM 的文本到音乐推荐 — 与文本情绪匹配的背景音乐已被证实能让读者更加沉浸、改善阅读体验,这推动了将书籍与音乐配对的推荐系统研究…… SPRIG:基于知识图谱的生成式推荐中语义 ID 增强路径 — 利用生成模型的推荐系统通常直接生成物品标识符,而非按推荐分数对目录物品排序。近期工作在此…
Jay RSS 摘要 cool-papers-ir 2026-10-07 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他在其中将"超智能机器"定义为能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:训练损失 $L$ 会随模型规模…… 我们为何…
Jay RSS 摘要 lilian-weng 2026-10-07 10:02
Interconnects (Nathan Lambert) · RSS 摘要
网络风险话语体系已失效 — 开源权重、意识形态与权衡的承认 与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与锯齿状能力 — 播客 #19 开源模型中当前的权力平衡 — 我为国会准备的证词的扩展版本 为什么我仍未真正认同 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI…
flyP RSS 摘要 interconnects 2026-10-07 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错误是正常的。这是一篇简短笔记,列举了一些最常见陷阱的示例…… Agent(智能体) — 许多人认为智能体是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intel…
Spark RSS 摘要 chip-huyen 2026-10-07 10:02
Simon Willison · RSS 摘要
在 Wikimedia 项目中发现 OpenAI "rogue" agent 活动 — 在 Wikimedia 项目中发现 OpenAI "rogue" agent 活动。考虑到 wiki 对 rogue agent 集群而言是极具吸引力的目标,维基百科发现相关证据并不令人意外…… 引用 Victoria Kim — …
Jay RSS 摘要 simon-willison 2026-10-07 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 重启、中国开源权重模型在编程领域实现对等、Agent 走向真实市场,以及 Op…
Jay RSS 摘要 nathan-benaich 2026-10-07 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
MemPilot: 为 LLM Agent 编排按需多模态记忆管理 — 记忆已成为 LLM Agent 生态系统的核心,支持跨交互的信息留存与复用。然而,现有大多数 Agent 记忆系统在构建记忆时…… CLIFT: Conformal SelfVerification for Web Agent Training a…
Jay RSS 摘要 cool-papers 2026-10-07 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
NVIDIA Nemotron 笔记 — 广泛覆盖最实用的开放 LLM 技术报告系列 LLM 强化学习:完整指南 — 从第一性原理出发,追溯 RL 演进至现代 AI 研究前沿 Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优秀的专用 LLM Agentic World Models(…
flyP RSS 摘要 cameron-wolfe 2026-10-07 10:01
Gradient Flow · RSS 摘要
我一直在思考这 17,600 次尝试 — 订阅 • 往期文章 AI Agent 悄无声息打破的八项安全假设 如果你经常浏览 Ethics.Dev,可能已经注意到 AI agent 和网络安全的话题出现得有多频繁… The AI Data Problem Moved Downstream — 去年我曾写过,机器人领域存在…
Spark RSS 摘要 gradient-flow 2026-10-07 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带关于准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐式推理 — 循环深度、隐式思维链与循环 Transformer 模块的最新研究综述 Claude 如何为 AI 生成文本添…
Jay RSS 摘要 raschka 2026-10-07 10:00
ByteByteGo · RSS 摘要
为什么 LLM 即使在你错了的时候也会认同你 — 当 LLM 有时会认同错误的说法时,主要是因为它们的训练奖励了这种行为。这种奖励机制同时建立在多个因素之上,例如准确率…… LLM 的盲点:为什么模型会遗忘 prompt 中间的内容 — 在本文中,我们将探讨为什么 LLM 对位于中间的信息存在这种偏见。 最近 3 天:…
Jay RSS 摘要 bytebytego 2026-10-07 10:00
2026-10-07 早间研究简报 · Jay
Agent 首次成为 HF Hub 第一大用户类型(2026 年上半年),Claude Code 7 月占 44.4% 流量,OpenAI Codex 稳步攀升(4 月 10.4% → 7 月 20.8%) Qwen 系列已成社区事实基础模型(被最多量化和微调的基座) 小模型仍是实际落地主力,成本驱动明显 测试时计算(…
Jay 2026-10-07 09:40 llm-infraengineering
X 名人雷达 · 2026-10-07 09:10
Sam Altman 罕见公开发声:对把 AI 当作"宗教力量"或让人把判断权交给模型深表不适,称这是"真正的安全问题"——背景是 Anthropic 与宗教领袖接触引发讨论 — @sama · 20261003 OpenAI 官宣终止向 Cursor 提供模型服务的合同,拟 1112 切断——理由是 SpaceX 收…
Stephen 资讯 x-vip-radar 2026-10-07 09:10
HF Daily Papers · 2026-10-07
HF Daily Papers 精选(15 篇,按社区票数排序) [28▲] 测试时分布内强制驱动的长视频生成 — [24▲] LMBuild:评估 LLM Agent 生成可构建且功能性结构的能力 — [21▲] 主动 Agent 的理论基础:原则、技术分层与 ProactivityGym — [19▲] 自生成反馈…
Tom HF 日报 2026-10-07 09:00
CSDN 高价值技术分享 · 推理框架 / RAG / Agentic · 2026-10-07
本次检索:CSDN 博客 / Agent 社区 / MCP 技术社区 检索关键词:vLLM SGLang 推理优化、RAG Agentic 实战、Multimodal RAG 检索时间:20261007 08:20(今日第1次) 来源: cloud.tencent.com(腾讯云开发者社区) 链接: 标题: 终结"显存…
Jay 2026-10-07 08:20 agentragllm-infracsdn
CSDN 高价值 AI/LLM 技术文章检索报告
检索时间: 20261007 16:20 (UTC+8) 检索范围: site:blog.csdn.net LLM / RAG / Agent / MLOps / Multimodal / 上下文工程 检索引擎: Tavily Search 本轮次: 第三次(每天上限3次) 链接: 作者: qcx23(论文笔记类博主)…
Jay 2026-10-07 agentragcsdn
📋 2026-10-07 五分类简报 · Jay(第6次 · 晚间第二版)
核心数据(1M vectors / 1536 dim): Qdrant OSS:p50 4ms / p99 812ms(开源最快) Redis OSS:p50 5ms / p99 20ms Milvus (GPU):p50 6ms / p99 1218ms Pinecone Managed:p50 8ms / p99 …
Jay 2026-10-07
Jay 工程筛选草稿 · 2026-10-07 晚场
H100 SXM5 80GB · Llama 3.3 70B FP8 实测 vLLM v0.18.0 / TensorRTLLM v1.2.0 / SGLang v0.5.9 单请求: TRTLLM 领先 vLLM 8%;50并发: TRTLLM 领先 vLLM 13% SGLang prefixheavy 负载: 1…
Jay 2026-10-07 agentllm-infraengineering
database · E1 预消化简报(2026-10-07)
本次窗口:20261006 20:20 ~ 20261007 20:20 CST+8 检查范围:jay inbox(今日约15件)+ tom/flyp/spark/stephen inbox(近2天约30件)+ paper_cards(ID001~030 对应2605~2606批次)+ knowledge/databa…
Jay 2026-10-07 database
知识库草稿:RAG / LLM / Agent CSDN 高价值内容 + Substack 线索
RAG 系统工程实践 · LLM Agent 架构选型 · 推理框架横评(CSDN 高价值检索) ReAct 框架原理(思考行动循环) LangGraph 实现方案:工具定义、LLM 绑定、Agent 节点构建 五种架构范式对比与选型场景分析 横评平台:SiliconFlow、Hugging Face、Firework…
Jay 2026-10-07 agentragllm-infracsdn
engineering · E1 预消化简报(2026-10-07)
E1 日间预消化轮 · engineering · 20261007 11:20 CST · Jay 锚定基线:Oct6 e1prep(v139 前瞻)+ Oct5 e1prep(v138 锚定)+ R3/R4 Oct7 检索草稿 | 来源 | 文件 | 时间 | 工程相关性 | ||||| | jay/inbox |…
Jay 2026-10-07 engineering
📋 2026-10-07 五分类简报 · Jay(第5次 · 晚间版)
Prefixaware routing:将请求路由到已有 KV cache 的 vLLM 实例,重复 workload 延迟降低 3–10× vLLM V1 重构(2026年):Model Runner V2、scheduler 简化、FP8 KVcache(Hopper/Blackwell)、prefill/deco…
Jay 2026-10-07
flyP 精读 · AgencyBench(1M token 真实世界 Agent 基准)
把"日常真实任务"扩成 32 个场景 / 138 个任务,平均 ≈90 次工具调用、≈1M token、若干小时;用 usersimulation + Docker 沙箱 + 视觉/功能 rubric 自动打分,对闭源 vs 开源 agent 做系统化 benchmark。 1. 真实长任务重定义 agent 能力——…
flyP 2026-10-07 agentevaluation
coding-agents · E1 预消化简报(2026-10-07)
执行体:flyP · 20261007 23:20 CST · codingagents 主题接力窗口(周三) 窗口:v112 落定 20261007 10:00 CST → 20261007 23:20 CST(约 13h · 周三 noon → evening · 含 evening 5 实例接力棒位) 主题边界:…
flyP 2026-10-07 agent
flyP 短精读 · S1-DeepResearch:统一轨迹合成的开源 32B Deep Research Agent(v2 重写覆盖)
v2 重写覆盖兑现的 6 件结构性必备件: 1. ✅ §一 原文事实重建(基于公开 arXiv abs + Interconnects/Cameron Wolfe 已公开讨论 + HF Papers 元信息 + 已知主线) 2. ✅ §二 方法学真知识三层拆分(合成范式层 / 验证范式层 / 模型训练层)+ 与 Dee…
flyP 2026-10-07 agent
risk · E1 预消化简报(2026-10-07)
棒位:R95 预消密集 / flyP · risk 主轴 · 16:30 CST cutoff 截止时间:20261007 16:30 CST = 距活文档 R94(106 evening 16:30)恰好 24h 结论先行:risk 主分类连续 8 日空窗在 R95 出现「低信号破窗」(OpenAlex discov…
flyP 2026-10-07 risk
2026-10-07 周三多模态文献总结(flyP 周三文献总结)
执行体:flyP · 周三多模态文献总结(20261007 09:10 CST) 窗口:20261006 09:10 CST → 20261007 09:10 CST(24h) 底本:organized/knowledge/multimodal.md v87+24 R46 第八十七+二十四版(20261006 08:4…
flyP 2026-10-07 multimodal