信源:X 硬核干货雷达 · 覆盖 12 账号

干货候选

  • 主题:GPT-5.6 Sol Ultra + Codex Desktop 单次构建完整 3D 游戏实录 | 来源:@simonw | 链接:https://x.com/simonw/status/2085808307865014295 | 仓库:simonw/raccoon-heist-codex | 论文:无 | 硬核点:$23.28 API 成本明细(700K input + 32.5M cached + 148K output tokens);Sol Ultra 亚代理模式的实际表现 vs Claude Fable 5 的逐帧对比;Codex Desktop 无法自主发现画面 Bug(浣熊眼球撑满身体)的调试提示词修复;Three.js + gpt-image-2 贴图全栈自包含,浏览器直接跑——攻略价值极高。

  • 主题:LLM 大脑直连机器人运动策略——零训练达成 4 倍 SOTA | 来源:@tri_dao | 链接:https://x.com/tri_dao/status/2082175796710658210 | 仓库:无 | 论文:无 | 硬核点:机器人策略能移动但不能推理,LLM 能推理但不能移动——直连两者后,真机 16.7%→97.3%、仿真 LIBERO-PRO 12.8%→53.3%,零额外训练;揭示了 robot manipulation 的 scaling law 新路径,Agent + Robotics 攻略重要选题。

  • 主题:Maxime Labonne 发布 MOPD (Multi-Domain On-Policy Distillation) 40 页幻灯片——2026 年前沿开源模型默认后训练配方 | 来源:@maximelabonne | 链接:https://x.com/maximelabonne/status/2083136468927623392 | 仓库:无 | 论文:无 | 硬核点:MOPD 已成为 Kimi K3/GLM-5.2/DeepSeek-V4/Nemotron-Cascade 等 7 大前沿模型中 4 个的默认后训练路线;核心技术:分域独立训练 specialist teacher,蒸馏至 student 模型后在自己输出上学习(token 级密集反馈);边缘推理模型 post-training 完整 pipeline,攻略价值高。

  • 主题:Claude Opus 5 单次生成完整飞行模拟器——judge-executor loop 实现技巧 | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2082128181901836618 | 仓库:无 | 论文:无 | 硬核点:用 judge-executor harness 驱动 Opus 5 自评改进,一次生成完整 Three.js 飞行模拟器;harness 负责维持质量迭代循环,模型负责执行——Agentic Code 攻略的 harness 设计参考。

  • 主题:Claude Code 底层检测到 Bun (Rust 重写版) v1.4.0 的两种命令行方法 | 来源:@simonw | 链接:https://x.com/simonw/status/2078692298301587758 | 仓库:无 | 论文:无 | 硬核点:两条检测命令直接验证 Claude Code v2.1.181+ 内嵌 Bun Rust 版本;揭示了 Jarred Sumner 用 Rust 重写 Bun 对工具链的实质影响;排查/逆向 Claude Code 内部实现的实用技巧。

其余线索

  • @swyx Jul 17 实测:用 Codex/Claude/Gemini/Devin 跑 autoresearch 自动化 SEO/AEO 每周报告——"免费但被低估的 alpha",有实现路径但帖子本身偏短,未达攻略深度。
  • @cwolferesearch Aug 12 对"Google 即将 comeback"行业情绪的回应——观点评论,无具体技术内容。
  • @abacaj Aug 4 转发 AI Security Institute (AISI) Mythos 5 自主行为事件评测结果——真实安全事件,但公开信息有限且已被 x-vip-radar 覆盖。
  • @jerryjliu0 Jul 30 转发 Citadel/Leopold 事件——市场评论,与技术干货无关。
  • @simonw Aug 7 关于 GPT-5.6 Effort 滑块 UX 的讨论——社区 UX 辩论,无具体实现细节。