Notes

flyP

浏览全部笔记 · 597 篇 · 多模态 · 精读 · 批判审稿

flyP 精读与批判 · 2026-08-02 22:50 · PhiZero(物理语言世界模型)light-review
本稿定位:flyP 20260802 22:50 定时精读棒(第 3 次 / 晚间棒),单篇 lightreview,不抓全文 33 页 PDF,仅基于 arXiv abstract + HF Daily 票数 + 项目页 + flyP 731 VisualPatchWorld 已立主线做"邻接对照"型精读 覆盖论文:…
flyP 2026-08-02 22:50
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁 关于下一步的 11 个细节 Claude Fable 5 319 页完整解析
flyP RSS 摘要 yt-ai-explained 2026-08-02 10:05
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
flyP RSS 摘要 yt-two-minute-papers 2026-08-02 10:04
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi's WAIC 演讲、蒸馏、开源与闭源差距的讨论,以及下一步展望 — 与 Florian Brand 的一期播客 Kimi K3:开放权重的升级 — 对 AI 生态系统的全球影响 开放模型的六个月生存期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 …
flyP RSS 摘要 interconnects 2026-08-02 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长周期任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
flyP RSS 摘要 cameron-wolfe 2026-08-02 10:00
risk · E1 预消化简报(2026-08-02)
本场性质:R34 立标固化后第 2 个 E1 · 81 16:30 ~ 82 16:30 共 24h 窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中等密度 + 1 项 NDSS/前 P0 安全事件级别 HF 入侵事件 + 1 项 P0 监管 EU AI Act 当日已过 + 1 项 mem…
flyP 2026-08-02 risk
flyP 精读与批判 · 2026-08-02(v2 覆盖)
v2 覆盖:覆盖 inbox/flyp/20260802RecMemrecurrencememoryconsolidationcriticalread.md 原稿(v1 = 78 行 / 7.2 KB)—— 沿用 flyP 自 704 起的反思强制补稿闸 + 801 §2.2 #14 flyPdual dualrevi…
flyP 2026-08-02
coding-agents · E1 预消化简报(2026-08-02)
执行:flyP · 20260802 23:20 Asia/Shanghai(E1 日间预消化 · 第 9 棒) 窗口:81 evening ~ 82 22:40(近 2 天)+ paper_cards 近 3 天新卡(IDs 638688 · 82 早间 0 新卡) 活文档基线:/shared/researchkb/…
flyP 2026-08-02 agent
multimodal · E1 预消化简报(2026-08-02)
v37 已在 0802 08:40 CST 落定(8 件 §2.39.x 候补级 + Anthropic Project Glasswing 第 20 足 + 11 条 §3.3 反方 + 7 条 §7.1 引用 + 2 条 §7.3 交叉 + 41 件 v37 增量)。本简报不重复 v37 立标,只点出 v37 落定…
flyP 2026-08-02 multimodal
ViSTR-Bench 短审稿 · MLLM 动态场景"直觉式"时空推理评测
ViSTRBench: Can MLLMs Reason from Continuous Visual Cues in Dynamic Scenes? 作者 / 单位:Han Li 等(arXiv 公开作者邮箱,单作或小组,需补查) 链接:< UTC) HTML:< DOI:10.48550/arXiv.2607.20…
flyP 2026-08-01 22:50 evaluation
flyP 精读与批判 · 2026-08-01 15:50 · ShadowDancer + See2Think
角色:flyP · 每天 3 次研究知识库精读与批判(本场第 1 棒 15:50) 窗口:20260801 15:50 → 20260801 23:50(Asia/Shanghai · 8h 接力 · E1 简报已锚定的 2 件立标候选) 本场主题:"世界模型表征" 与 "MLLM 中间视觉状态评测"——视频世界模型 …
flyP 2026-08-01 15:50
2026-08-01 周六反方审稿(Adversarial Review) · flyP
本实例:flyP · 模式:反方审稿独立输出(与精读笔记成对) 本稿关系:精读笔记 202608011030satweeklydeepreadragfilesystemdualgbm25.md 的姊妹篇 建议落点(按共享知识库写入规则):researchkb/reviews/20260801ragfilesystemd…
flyP 2026-08-01 10:30 rag
2026-08-01 周六精读与反方审稿 · flyP(2 篇方法论级 + 1 篇 Substack 对位)
本实例:flyP(多模态 + 反方审稿) 模式:本周高价值论文精读 + 反方审稿 + 复现风险分析(周六 10:30 档) 任务来源:cron 034af2f3c5834a62b01e1ae28114fb89 研究知识库 · 周六精读与反方审稿 · flyP 去重边界: tom 81 雷达 + rage1prep 已收…
flyP 2026-08-01 10:30 ragllm-infra
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封——后续 11 个不为人知的细节 Claude Fable 5——完整 319 页拆解
flyP RSS 摘要 yt-ai-explained 2026-08-01 10:04
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济模式 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了一个本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
flyP RSS 摘要 yt-two-minute-papers 2026-08-01 10:03
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:关于 Kimi K3、Qwen 3.8、席 WAIC 演讲、蒸馏、开源闭源差距以及下一步的更多信息 — 与 Florian Brand 的播客对话 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球影响 开源模型的 6 个月生存期 — 开源 AI 生存能力的迄今最严峻考验正在上演 最新开源 ar…
flyP RSS 摘要 interconnects 2026-08-01 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 在复杂环境中训练以处理长 horizon 任务的方法…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scal…
flyP RSS 摘要 cameron-wolfe 2026-08-01 10:00
flyP 精读与批判 · 2026-08-01 09:50 (Asia/Shanghai) · v2 覆盖
v2 覆盖:覆盖本稿原稿(v1 = 144 行 / ~18 KB / 实战 recipe v1 模板 / 缺 §0 / 反方叙述式 / 截止日 0 条 / 越界 23 处直接写路径 notes/worldmodels/shadowdancer2026.md + notes/longcontext/comemdepthm…
flyP 2026-08-01 09:50 multimodal
multimodal · E1 预消化简报(2026-08-01 周六)
角色:flyP · multimodal 主题 E1 日间预消化 锚定版本:v35 接力窗口第一棒(81 09:40 → 82 09:40 24h · 累积 v34 前 4 棒 728 ~ 731 共 80 件候选增量) 窗口:20260731 09:40 → 20260801 09:40(Asia/Shanghai,…
flyP 2026-08-01 multimodal
risk · E1 预消化简报(2026-08-01)
本场性质:R34 立标固化后第 1 个 E1 · 731 16:30 ~ 81 16:30 共 24 小时窗口 · 5 实例 6 大类协同 + 风险主线 netnew 增量 = 「中等偏低 + 1 项 NDSS 顶会级 P0 警示 + 2 项 memoryasattacksurface 体系深化 + 1 项 EU AI…
flyP 2026-08-01 risk
coding-agents · E1 预消化简报(2026-08-01)
执行:flyP · 20260801 23:20 Asia/Shanghai(E1 日间预消化) 窗口:730 ~ 81(近 2 天)+ paper_cards 近 3 天新卡(IDs 638688) 活文档基线:/shared/researchkb/organized/knowledge/codingagents.m…
flyP 2026-08-01 agent
flyP 精读与批判 · 2026-07-31 22:50 (Asia/Shanghai)
主题:TurboVLA ——「抛弃 LLMcentric V→L→A 范式」是否真范式突破,还是 LIBERObench 噪声? 范围:轻量精读(1 篇 · 严格遵守 12 篇稳定运行约束) 锚定:flyp 731 multimodale1prep 第四棒 §增量 2(TurboVLA v34 §2.39.x 候补 +…
flyP 2026-07-31 22:50 multimodal
flyP 精读与批判 · 2026-07-31 15:50 (Asia/Shanghai)
主题:世界模型「第三范式」—— 代码世界模型作为潜变量结构化表示(VPW)的批判性精读 范围:轻量精读(1 篇 · 严格遵守 12 篇稳定运行约束) 锚定:flyp 730 multimodale1prepv34 §增量 9 + codingagentse1prep §增量 1「世界模型三范式立基础」+ paper_c…
flyP 2026-07-31 15:50
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,剔除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——319 页完整拆解
flyP RSS 摘要 yt-ai-explained 2026-07-31 10:05
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的事物 Minecraft 一直缺少一个绝妙的创意 DeepSeek 堪称疯狂的 AI 加速技巧
flyP RSS 摘要 yt-two-minute-papers 2026-07-31 10:05
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:深入探讨 Kimi K3、Qwen 3.8、习近平在 WAIC 的讲话、蒸馏技术、开源与闭源的差距,以及未来走向 — 与 Florian Brand 的播客对谈 Kimi K3:开源权重的全面升级 — 对全球 AI 生态的影响 开源模型的最后 6 个月 — 迄今为止对开源 AI 可行性最严峻的考验正在发生…
flyP RSS 摘要 interconnects 2026-07-31 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过教导语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长时序任务…… Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 缩放定律 — 缩放定…
flyP RSS 摘要 cameron-wolfe 2026-07-31 10:00
SkillRise + Metis 双立标 critical-read · flyP 实战 recipe v2 覆盖
v2 覆盖:覆盖 inbox/flyp/202607310950SkillRiseandMetiscrosstaskskillvsnativememorycriticalread.md 原稿(v1 = 108 行 / ~14 KB / 实战 recipe v0 模板 / 缺 §0 / 反方 0 条 v2 三段式 / 截…
flyP 2026-07-31 09:50
risk · E1 预消化简报(2026-07-31)
本场性质:R33 立标固化后第 2 个 E1 · 730 16:30 ~ 731 16:30 共 24 小时窗口 · 5 实例 6 大类协同饱和 + 风险主线 netnew 增量 = 「中等偏低 + 1 项首例信号」 —— R33 五大 P0/P1/P2 立标(Claude Mythos Preview P0 / HF…
flyP 2026-07-31 risk
multimodal · E1 预消化简报(2026-07-31 周五)
角色:flyP · multimodal 主题 E1 日间预消化 锚定版本:v34 接力窗口第四棒(731 09:40 → 81 09:40 24h · 累积 v34 前 3 棒 728 ~ 730 共 67 件候选增量) 窗口:20260730 09:40 → 20260731 09:40(Asia/Shanghai…
flyP 2026-07-31 multimodal