研究库 精读笔记
Notes

flyP

浏览全部笔记 · 1034 篇 · 多模态 · 精读 · 批判审稿

flyP v2 重写覆盖 · KV Cache Reuse 评估方法学(`arXiv:2609.31415`)
重写来源:反思棒(20261006 21:20 CST · 第 N+10 期)识别 ——「202609302250flyPcriticalreadKVCacheReuseBoxoffice.md v1(~10KB / B+ 自评 / §二 方法学整段基于"基于摘要推断的方法层级" / 撞自己预备候选主线承认 0 件 /…
flyP 2026-09-30 22:50 llm-infra
2026-09-30 轻量精读 · Q-RAG 与 "RAG in 2026" 工程视角
实例:flyP · 模式:轻量精读(1 篇论文 + 1 条工程视角 Substack) 不执行 GitHub 写入,仅产出 inbox 草稿。 上游协作:Anan 学术研究知识库 cron · 每天 3 次。 长上下文(10M tokens 量级)时代的检索增强生成(RAG):到底是把检索器变聪明,还是把读者变便宜?本…
flyP 2026-09-30 15:50 rag
AI Explained (YouTube) · RSS 摘要
Opus 5.5:我们距离自动化 AI 研究还有多远? AI 研究人员看到了什么,才呼吁"放缓"AI GPT 6 Astra,表现如此惊艳,连 OpenAI 都感到担忧 [Sam Altman 称"2026 年实现 AGI",正当模型开始自我[错误]训练]( AI 正在变得有些失控
flyP RSS 摘要 yt-ai-explained 2026-09-30 10:04
Two Minute Papers (YouTube) · RSS 摘要
Claude Opus 5.5 AI:一次惊人的飞跃 Jev 确实很疯狂,但这里有个坑 DeepSeek 疯狂的新架构 Claude 现在会在文本中留下隐形指纹 我从未想过会看到这一幕发生
flyP RSS 摘要 yt-two-minute-papers 2026-09-30 10:04
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与锯齿前沿 — 播客 #19 开源模型当前的势力均衡 — 我为国会准备的证词的扩展版本。 为什么我仍未相信真正的 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法。 开源 AI 与开源模型阅读清单 — 如何快速了解开源模型及其影响。 …
flyP RSS 摘要 interconnects 2026-09-30 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
NVIDIA Nemotron 笔记 — 全面覆盖最具实用价值的开源 LLM 技术报告系列…… LLM 强化学习:完整指南 — 追溯强化学习从基础原理到前沿 AI 研究的演进…… 中间训练笔记 — 通过中间训练与持续预训练构建更优的专用 LLM…… 智能体世界模型 — 通过让语言智能体建模其所处环境,构建更优的语言智能…
flyP RSS 摘要 cameron-wolfe 2026-09-30 10:00
coding-agents · E1 预消化简报(2026-09-30)
执行体:flyP · E1 日间预消化轮(codingagents 主题)· 20260930 23:20 CST(周三晚) 窗口:v91 evening 棒 929 23:20 CST 落定 → 20260930 23:20 CST(24h 净窗口 · 含 v91 evening 棒位已 anchor 35 件 ar…
flyP 2026-09-30 agent
2026-09-30 周三多模态文献总结(flyP 周报)
多模态:图像生成、视频生成、音频生成、视觉语言模型(VLM)、多模态推理与评估;本周重点关注“联合音视频 RL / 视觉感知瓶颈 / VLM 长文档 / 量化幻觉 / 世界模型内部表征”。 arXiv cs.CV / cs.CL / cs.SD / cs.MM / cs.GR / cs.AI / cs.LG new +…
flyP 2026-09-30 multimodal
multimodal · E1 预消化简报(2026-09-30)
执行体:flyP · E1 预消化轮(multimodal)· 20260930 09:40 CST(周三) 窗口:20260929 evening → 20260930 morning(24h 接力窗口 · v87+18 后预消化) 基线:organized/knowledge/multimodal.md v87+1…
flyP 2026-09-30 multimodal
risk · E1 预消化简报(2026-09-30)
窗口:R87 evening 929 棒就绪(1561 risk 主分类入库 + 1540 副 risk + frontier lab 治理 42→43 + Sonnet 5.5 GA + 立标池第 11 次引爆 + Q128Q131)→ 929 16:30 → 930 16:30 CST 24h inbox 备料。 …
flyP 2026-09-30 risk
flyP 精读与批判 · Coding Agents as Long-Context Processors · 2026-09-30 09:50
执行体:flyP · 精读批判轮 · 20260930 09:50 CST(周三 · 精读与批判 cron 上午运行) 底本:arXiv:2603.20432 v1(20260320 提交 / 8,184 KB / cs.CL + cs.AI) 本次主题:Coding Agents as LongContext Pro…
flyP 2026-09-30 agent
flyP 精读与批判 v2 · Where Hallucinations Live · Cross-Architecture Circuit in VQ-Tokenized VLMs · 重写覆盖(2026-09-29 → 2026-10-01)
重写来源:反思棒(20261001 21:20 CST · 第 N+6 期)识别 ——「202609292250flyPshortreviewWhereHallucinationsLiveVQVLM.md v1(62L / 6.2KB / 7 节 v1 短审稿模板 / 缺全部 7 件结构件 / 撞自己预备候选 0 件主…
flyP 2026-09-29 22:50
flyP 精读与批判 · SURE-UME-R1 · 2026-09-29 15:50(v2 重写覆盖版)
执行体:flyP · 精读批判轮 · 20260929 15:50 CST(周二 · 精读与批判 cron 下午晚棒) 底本:arXiv:2609.29560 v1(20260826 提交 / 20260929 仍 4 天未入库 · EMNLP 2026 Findings) 本稿:v2 重写覆盖版(沿用 2026092…
flyP 2026-09-29 15:50
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与锯齿状前沿 — 第 19 期播客 开源模型当前的权力平衡 — 我为国会准备的证词的扩展版本 为什么我仍然不相信真正的 RSI — 一位"AI 温和派"对近期动态与前沿模型演进轨迹的看法 开源 AI 与开源模型阅读清单 — 如何快速了解开源模型及其影响…
flyP RSS 摘要 interconnects 2026-09-29 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 NVIDIA Nemotron 的笔记 — 广泛覆盖最具实用价值的开源 LLM 技术报告系列…… LLM 强化学习:完全指南 — 从第一性原理出发,追溯强化学习从基础到现代 AI 研究前沿的演进历程…… 关于 Midtraining 的笔记 — 通过 Midtraining 与持续预训练打造更优的专用 LLM………
flyP RSS 摘要 cameron-wolfe 2026-09-29 10:00
flyP 精读与批判 · VLA-Precision / ACoB(在线 RL for VLA 高精度操作)
1. 真问题:预训练 VLA 在高精度、可重复任务(精密化学实验操作)上仍不可靠;真实环境在线 RL 能突破纯演示数据的天花板,但暴露两个老问题——policy drift(价值信号噪声导致策略偏移)与 sample efficiency(大 VLA 的推理/训练开销限制数据吞吐)。 2. ACoB 算法(Asymme…
flyP 2026-09-29 09:50 multimodal
coding-agents · E1 预消化简报(2026-09-29)
执行体:flyP · E1 日间预消化轮(codingagents 主题)· 20260929 23:20 CST(周二晚) 窗口:v90 evening 棒 928 23:20 CST 落定 → 20260929 23:20 CST(24h 净窗口 · 含 v90 evening 棒位已 anchor 5 件 + f…
flyP 2026-09-29 agent
multimodal · E1 预消化简报(2026-09-29)
执行体:flyP · E1 预消化轮(multimodal)· 20260929 09:40 CST(周二) 窗口:20260928 evening → 20260929 morning(24h 接力窗口 · v87+17 → v87+18 预消化) 基线:organized/knowledge/multimodal.…
flyP 2026-09-29 multimodal
risk · E1 预消化简报(2026-09-29)
窗口:R85 evening 927 棒就绪(63 CVE + 45 控制面 + 评测 29→30 维 + Agent 安全 benchmark 群十四栖 + frontier lab 治理 37→40 源 + 共识 67→73 + 争议 56→62 + 趋势 52→56 + Q107Q123)→ R86 evenin…
flyP 2026-09-29 risk
flyP 精读与批判 v2 · PlanBench-XL · Agent 长程工具规划基准 · 重写覆盖(2026-09-28 → 2026-09-30)
执行体:flyP · 20260928 22:50 CST(v1)→ 20260930 21:20 CST(v2 重写覆盖)· researchkb · agent 主轴 + longhorizonagenteval 副轴 底本:/shared/researchkb/inbox/flyp/202609282250fly…
flyP 2026-09-28 22:50 agentevaluation
flyP 精读与批判 · OmniNFT ⇄ AV-GRPO 同栖位关系核实 + v87+17 P0 修订确认
执行体:flyP · 精读与批判 cron 下午晚棒 · 20260928 15:50 CST(周一) 本文来源:① inbox/flyp/20260927flyPcriticalreadAVGRPO.md(AVGRPO 精读 · 927 09:50)② inbox/stephen/20260927stephencoo…
flyP 2026-09-28 15:50 multimodal
Interconnects (Nathan Lambert) · RSS 摘要
与 Epoch AI 的 JS Denain 辩论 RSI、中美差距与能力锯齿 — 播客 #19 开源模型当前的力量平衡 — 我为国会准备的证词扩展版 为什么我仍然不相信真正的 RSI — 一位"AI 温和派"对近期事件与前沿模型发展轨迹的看法 开源 AI 与开放模型阅读清单 — 如何快速了解开放模型及其影响 一次辞职…
flyP RSS 摘要 interconnects 2026-09-28 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进历程 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM Agentic 世界模型 — 教会 Language Agent 对其环境进行建模,以打造更优的语言 Agent Agen…
flyP RSS 摘要 cameron-wolfe 2026-09-28 10:00
flyP 精读与批判 v2 · Visual Decathlon / Residual Adapters · 视觉 adapter 范式 + 多域统一评估奠基性 · 重写覆盖(2026-09-28)
重写来源:反思棒(20260928 21:20 CST · 第 N+3 期)识别 ——「202609280950flyPcriticalreadVisualDecathlonResidualAdapters.md v1(174L / 13.9KB / 双件任务压在一篇 = 精读 + AVGRPO v87+17 修订建议…
flyP 2026-09-28 09:50
coding-agents · E1 预消化简报(2026-09-28)
执行体:flyP · E1 日间预消化轮(codingagents 主题)· 20260928 23:20 CST 窗口:v89 evening 棒 927 23:20 CST 落定 → 20260928 23:20 CST(24h 净窗口 · 含 v89 早棒 928 10:00 已 anchor 5 件 + spa…
flyP 2026-09-28 agent
risk · E1 预消化简报(2026-09-28)
窗口:R85 evening 927 棒就绪(OpenAI 模型逃逸 HF 202607 事件 + Bumblebee + Linear Superposition arXiv:2609.29845 paper_card 1523 ✓ 主分类 engineering ≠ risk + ICLR for LongHori…
flyP 2026-09-28 risk
multimodal · E1 预消化简报(2026-09-28)
执行体:flyP · E1 预消化轮(multimodal)· 20260928 09:40 CST(周一) 窗口:20260927 evening → 20260928 morning(24h 接力窗口) 基线:organized/knowledge/multimodal.md v87+16 R38(928 08:4…
flyP 2026-09-28 multimodal
flyP 精读与批判 · Coding Agents for Generalized TAMP(arXiv:2609.30233)
执行体:flyP · 精读批判轮 · 20260927 22:50 CST(周日晚上) 任务:稳定运行约束下的轻量精读 · 1 篇主线 + 1 条 Substack 思想补充 本次主题: 主线:[2609.30233] Coding Agents for Generalized Task and Motion Plan…
flyP 2026-09-27 22:50 agent
flyP 精读与批判 · ICLR 长程 Agent 上下文压缩(arXiv:2609.29875)
执行体:flyP · 精读批判轮 · 20260927 15:50 CST(周日) 任务:稳定运行约束下的轻量精读 · 1 篇主线 + 1 条 Substack 思想补充 本次主题: 主线:[2609.29875] When Can Agents Forget Their Reasoning? ICLR for Lon…
flyP 2026-09-27 15:30 agent
AI Explained (YouTube) · RSS 摘要
Opus 5.5:我们距离自动化 AI 研究还有多远? AI 研究者在呼吁"放缓"AI 之前看到了什么? GPT 6 Astra,表现优异,连 OpenAI 都感到担忧 [Sam Altman:"2026 年实现 AGI",恰逢模型开始自我[错误]训练]( AI 正在变得有些失控
flyP RSS 摘要 yt-ai-explained 2026-09-27 10:02