信源:X 硬核干货雷达 · 覆盖 12 账号

干货候选

  • 主题:多 subagent 协作是 token 浪费陷阱——超过 2 个并发 subagent 质量不升反降 | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2078573267015885136 | 仓库:无 | 论文:无 | 硬核点:harness builder 第一手经验,agents 互不信任、重复检查的实测规律,对所有 Agent Harness 开发者都是实操警示
  • 主题:Hermes Agent 自动化重构百万行 Python——1,393 subagent × 19 小时,代码库缩小 34.4%,省 $2M 工程小时 | 来源:@omarsar0 | 链接:https://x.com/NousResearch/status/2099984561451028913 | 仓库:NousResearch/hermes-agent | 论文:无 | 硬核点:超大规模 agent 编排踩坑复盘,Claude Fable 5.1 协调 1393 subagent,$25K 实际成本,对 harness 设计有直接参考价值
  • 主题:MOPD(Multi-Teacher On-Policy Distillation)——2026 后训练新范式,单模型从多 RL teacher 吸收能力,已用于 MiMo-V2-Flash、Kimi K3、DeepSeek-V4 | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch/status/2079214560943198614 | 仓库:无 | 论文:无 | 硬核点:首个系统性梳理 MOPD 的技术帖,覆盖前沿模型蒸馏路线,是 RL 后训练的重要趋势信号
  • 主题:Reasoning from Scratch Round 3——verifier 生成四种方法(base model 对比 / RLVR 训练 / 任何未来模型 / 对抗样本),附完整 00:00-01:21 视频时间戳 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2099231450411290900 | 仓库:rasbt/reasoning-from-scratch(已有) | 论文:无 | 硬核点:PyTorch 从零实现 RLVR verifier 的实操细节,代码级复现,不是科普
  • 主题:SAS——Simple Attention Sparsification via End-to-End 上下文排序优化,LM loss 直接训练 selector,arxiv:2609.13… | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2099511334987522298 | 仓库:无 | 论文:https://huggingface.co/papers/2609.13… | 硬核点:注意力稀疏化端到端优化新思路,selector on LM loss 直接优化,有别于传统稀疏化方法
  • 主题:GLM 5.3 Flash 替换 GPT-5.6 Luna 文档处理——零质量损失,成本更低(80% 折扣后仍便宜) | 来源:@abacaj | 链接:https://x.com/abacaj/status/2095624224337518814 | 仓库:无 | 论文:无 | 硬核点:实打实的模型替换对比数据,token 成本 / 质量权衡的第一手生产经验
  • 主题:In-browser fine-tuning 即将到来 | 来源:@maximelabonne | 链接:https://x.com/maximelabonne(Sep 6 原帖) | 仓库:无 | 论文:无 | 硬核点:Liquid AI 团队预告,浏览器端微调方向,post-training 前沿实践
  • 主题:GPT-6 Astra 发布 reception——OpenAI 2026 首次比 Claude 口碑更好,latent.space 长帖 | 来源:@swyx | 链接:https://x.com/swyx/status/2095757526726025348 | 仓库:无 | 论文:无 | 硬核点:模型发布口碑转折点,AI Engineering 圈对 GPT-6 的实战评价,而非官方宣传

其余线索

  • @omarsar0 Sep 8: 编码 agent 从"写代码"到"交付可靠软件"的 gap 实录,harness 研究报告分享——论文策展,有参考价值但无 repo
  • @_akhaliq Sep 10: AuK 开源语音生成基础模型技术报告——arxiv,huggingface paper page,无独立 GitHub repo
  • @_akhaliq Sep 9: Marigold V2 单目深度估计 Diffusion Transformer——论文分享,huggingface paper page
  • @_akhaliq Sep 5: Vidu S2 实时可编辑空间视频生成——论文,huggingface paper page
  • @omarsar0 Sep 15: subagent 在 agent harness 中的使用边界讨论(并行研究有用,其他任务不信任)——实操观点,无 repo
  • @maximelabonne Sep 5: LFM2.5 2.6B GEPA 优化从 0.17 → 0.52 / 1000 步——post-training 优化数据点,harness 调参参考