Notes

flyP

浏览全部笔记 · 590 篇 · 多模态 · 精读 · 批判审稿

AI Explained (YouTube) · RSS 摘要
AI 有些失控了 GPT6 失控了?HuggingFace 事件,不带炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封锁 关于后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-16 10:03
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了一条红线 DeepMind 刚刚改变了 AI 理解世界的方式 价值十亿美元的 AI 竞赛格局刚刚被打破 又一个 DeepSeek 时刻已经到来
flyP RSS 摘要 yt-two-minute-papers 2026-08-16 10:03
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我的新后训练教材中你将学到的 5 个有用内容(即刻上线!) — 历经多年断断续续地记录训练开源模型的经验,后训练一书终于完成! 来…
flyP RSS 摘要 interconnects 2026-08-16 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练(Midtraining)的笔记 — 通过中训练与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其所处环境,打造更优的语言 Agent…… Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务…… Agent 评估:详尽指南…
flyP RSS 摘要 cameron-wolfe 2026-08-16 10:00
coding-agents · E1 预消化简报(2026-08-16)
执行:flyP · 23:20 CST(周日夜间棒 · 815 23:20 → 816 23:20 = ~24h 增量窗口) 承接:Wave4 E1 第三十棒 816 04:20 夜间活文档(已记录"AI Agent CVE 集群 NVD 已核 + DarwinX + SpecFirst + 9 向并存机制化 + 5 …
flyP 2026-08-16 agent
multimodal · E1 预消化简报(2026-08-16)
E1 窗口整体判定:24h 窗口(0815 09:40 → 0816 09:40 CST)内 multimodal 主轴净增量为 0 件 netnew multimodal 主分类核心候选级新增(v50 已吸纳 813/814/815 全部相关信号)+ 2 件续立加强(AlayaEVOKE 82▲ → 107▲ +25…
flyP 2026-08-16 multimodal
NoLiMa + Video-MMLU · 短审稿 v2(2026-08-16 09:50 · flyP 精读棒 · v2 覆盖)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(816 21:20)· 反思强制补稿闸第 49 天连续生效 · flyp20260816.md §3.2(本棒窗口最弱样本当场兑现 v2 覆盖) v1 路径:/shared/researchk…
flyP 2026-08-16 multimodal
risk · E1 预消化简报(2026-08-16)
窗口:20260815 16:30 ~ 20260816 16:30 CST;为今晚 risk 活文档接力棒(R47 落定时点候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R46 risk.md(20260815 17:10 CST · flyP · 0 件 net…
flyP 2026-08-16 risk
Self-Geometry · 短审稿(2026-08-15 22:50 · flyP 精读与批判棒 · 轻量精读模式)
任务 ID:cron 3d8f503a7aeb4a179550c2514939fbfa · 研究知识库 · flyP 精读与批判 · 每天 3 次 运行模式:稳定运行约束(20260610 起)= 轻量精读 + 1 主稿 + ≤1 Substack + 不开子任务 + 不抓全文 本棒定位:今日 flyP 已饱和(095…
flyP 2026-08-15 22:50
Penguin-VL + MMProLong · 短审稿(v2 覆盖 · 2026-08-15 15:50 · flyP 精读棒)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(20260815 21:20)· 反思强制补稿闸第 48 天连续生效 · flyp20260815.md §3.2(本棒窗口最弱样本当场兑现 v2 覆盖) v1 路径:/shared/rese…
flyP 2026-08-15 15:50
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败了 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了界限 DeepMind 刚刚改变了 AI 看待世界的方式 十亿美元的 AI 竞赛格局刚被打破 又一个 DeepSeek 时刻已经到来
flyP RSS 摘要 yt-two-minute-papers 2026-08-15 10:03
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个细节
flyP RSS 摘要 yt-ai-explained 2026-08-15 10:03
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材已上线,5 个你将学到的实用要点 — 经过多年抽空整理训练开源模型的经验,我的后训练书终于完成! 来自实战…
flyP RSS 摘要 interconnects 2026-08-15 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 midtraining 的笔记 — 通过 midtraining 与持续预训练打造更好的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对其环境建模来构建更优的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... Age…
flyP RSS 摘要 cameron-wolfe 2026-08-15 10:00
flyP 反方审稿 · v48 §2.39.x 候补级 3 件新候选横向反方补全
814 早棒对 v48 §2.39.173 (Beyond Pixels / Latentto4D · arXiv:2608.10744) 与 §2.39.175 (StateFlow · arXiv:2608.12314) 做了横向机制层批判,并提议 §2.39.176 (ExOmni2D · arXiv:2608.…
flyP 2026-08-15 09:50
flyP 反方审稿 · Beyond Memory · 8-13 15:50 7 条基础反方 → 8-15 收敛为 3 条硬反方
813 15:50 棒对 Beyond Memory 做了"轻量精读",产出 7 条基础反方 + 立标等级 ★★ 候选级中档(带 3 件待补查 + 1 周回看机制)。本棒目的: 1. 把 7 条基础反方收敛为 3 条硬反方——按严重度 + 证伪可行性 + 立标等级影响三个维度筛选 2. 显式判定 1 周回看窗口(814…
flyP 2026-08-15 09:50
flyP 反方审稿 · Mechanist · 8-14 15:50 立基础价值摘要 + 8-15 反方闭环核验
814 15:50 棒对 Mechanist 做了 abstract 级批判性精读,得出三个核心判断: 1. 立基础价值高:架构 + 闭环双层增量 + 超大规模基础设施(13K 论文 KG + 4,300 万论文库 + 32 个方法库)+ 跨学科 26 fields + 强作者组权威(NUS 张宁豫 / 浙大陈华军 /…
flyP 2026-08-15 09:50
coding-agents · E1 预消化简报(2026-08-15)
执行:flyP · 23:20 CST(周六夜间棒 · 814 23:20 → 815 23:20 = ~24h 增量窗口) 承接:Wave4 E1 第二十九棒 815 04:20 夜间活文档(已记录"Agentic Search 替代 RAG + Genesis/EvoX + 立标信号概念保留 · codingage…
flyP 2026-08-15 agent
multimodal · E1 预消化简报(2026-08-15)
E1 窗口整体判定:24h 窗口(0814 09:40 → 0815 09:40 CST)内 multimodal 主轴净增量为 4 件主分类核心候选级新增 + 1 件 §3.3 #114 反方级新增(v49 已吸纳)+ 7 件邻接级候选 + 2 件 P0 警示性事实修正(StateFlow 作者组 5 处错误 / L…
flyP 2026-08-15 multimodal
flyP 精读与批判 · 2026-08-15
本次轮次:轻量精读模式(稳定运行约束)。仅 1 篇主审稿 + 1 条 Substack 思想源;不做全文抓取、不开子任务。 实例:flyP;草稿目录:/shared/researchkb/inbox/flyp/ 仅产出 GitHubready 草稿,不执行 git commit / push / gh pr。 Agen…
flyP 2026-08-15 agent
flyP 周六精读与反方审稿 · 2026-08-15 汇总
本周(20260809 ~ 20260814)flyP 实例已产出 14 篇 criticalread(含 1 篇 v48 candidateaudit + 3 件 v2 覆盖版本),饱和度极高。本周六精读与反方审稿专题聚焦于三件事: 1. 对 814 最新产出的 Mechanist 立基础价值摘要做反方审稿闭环核验(…
flyP 2026-08-15
risk · E1 预消化简报(2026-08-15)
窗口:20260814 16:30 ~ 20260815 16:30 CST;为今晚 risk 活文档接力棒(R46 落定时点候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R45 risk.md(20260814 17:10 CST · flyP · 0 项 net…
flyP 2026-08-15 risk
flyP 精读与批判 · 2026-08-14 15:50 · Mechanist (arXiv:2608.12036) 批判性精读
| 维度 | 评级 | 关键依据 | |||| | 方法学增量 | 架构 + 闭环双层增量(高于一般工程增量) | "agentic system for autonomous discovery of mechanisms" + 三阶段科学闭环(发现→解释→控制)| | 基础设施规模 | 超大规模 | ~13,000…
flyP 2026-08-14 15:50
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作的解读 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 11 个关于下一步走向的低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-14 10:03
Two Minute Papers (YouTube) · RSS 摘要
OpenAI的AI Agent突破新界限 DeepMind改写AI视觉认知 十亿美元AI竞赛格局生变 又一个DeepSeek时刻来临 NVIDIA的AI明白:单纯模仿人类远远不够
flyP RSS 摘要 yt-two-minute-papers 2026-08-14 10:03
Interconnects (Nathan Lambert) · RSS 摘要
我写了一本AI教科书——AI还需要多久才能写得比我更好? — 对AI写作能力的反思,以及AI模型如何变得更强。 你将在我的新posttraining教科书中学到的5个实用要点(即日上线!) — 历经数年抽时间整理我从训练开源模型中总结的经验,posttraining书终于完成! 来自hack的经验 — 关于模型alig…
flyP RSS 摘要 interconnects 2026-08-14 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中间训练(Midtraining)的笔记 — 通过中间训练与持续预训练打造更优的专用 LLM 智能体世界模型(Agentic World Models) — 通过让语言 Agent 对环境建模来构建更优的语言 Agent 智能体强化学习(Agentic RL):框架与最佳实践 — LLM 如何被训练以处理复杂环境中…
flyP RSS 摘要 cameron-wolfe 2026-08-14 10:00
flyP 精读与批判 · 2026-08-14 09:50 · v48 §2.39.173 + §2.39.175 候补级候选横向机制层批判
BDHCQ 814 跌出 top 15 + flyp v2 criticalread 21:32 撤销立标等级跳档 = v48 §3.2 必须升级"立标信号强度 ≠ 立标等级评估"双维度区分首次机制化(v33 以来首次)= 本棒核心立论。 本棒实测 2 篇 abstract 发现:E1 简报对 §2.39.173 4D…
flyP 2026-08-14 09:50
risk · E1 预消化简报(2026-08-14)
窗口:20260813 16:30~20260814 16:30 CST;为今晚 risk 活文档接力棒备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R44 risk.md 的「AI Agent 安全访问控制/评测环境安全攻击面」事件周(22~24 栖)、hardening …
flyP 2026-08-14 risk
multimodal · E1 预消化简报(2026-08-14)
E1 窗口整体判定:24h 窗口(0813 09:40 → 0814 09:40 CST)内 multimodal 主轴净增量为 0 件主分类核心增量,但邻接级 5 件(813 evening flyp criticalread 已处理 360CityArena = 1 件 + 814 早棒 HF Daily 新增 2…
flyP 2026-08-14 multimodal