信源:X 硬核干货雷达 · 覆盖 12 账号

干货候选

  • 主题:Procedural Graphs — Google 自进化 LLM Agent 执行结构图(拒绝的图编辑留档防重复犯错) | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2097755424007373270 | 仓库:无 | 论文:https://arxiv.org/abs/2609.09153 | 硬核点:知识图谱+自进化图结合, agent 长期记忆/规划的新结构, 值得写实现踩坑攻略
  • 主题:Google Stellar Colosseum — 多 Agent Harness 协作证明数学猜想(FOCS/JMLR 公开问题新结果) | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2099924717704732699 | 仓库:无 | 论文:无(arxiv 待确认) | 硬核点:分阶段探索策略优于立即分解子问题,多 Agent 推理 Harness 工程实践,值得写攻略
  • 主题:Coding Agents 距离可靠软件交付的差距 — 2024–2026/09 现场研究+基准审计+生产报告综合 | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2097368121468453044 | 仓库:无 | 论文:无 | 硬核点:代码生成→可靠交付之间 review/集成/测试/安全/部署才是真正瓶颈,生产 AI 工程必读
  • 主题:Giles Thomas 6-Expert MoE GPT-2 从零训练:单 GPU 8 天,完整数学推导+代码 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2098129926708707824 | 仓库:无(代码在 gilesthomas.com) | 论文:无 | 硬核点:单 GPU 可复现的 MoE 实验, rasbt 书配套实战,值得写分布式训练踩坑攻略
  • 主题:KV Cache 从零理解与代码实现 — rasbt 博客配套教程 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2096611271814611179 | 仓库:无 | 论文:无 | 硬核点:KV Cache 机制细节图解,大模型推理优化的重要前置知识
  • 主题:LLM 写代码→让 Agent 更好操控浏览器 — computer use 性能提升的本质催化剂 | 来源:@hwchase17 | 链接:https://x.com/hwchase17/status/2097794466232905769 | 仓库:无 | 论文:无 | 硬核点:code-writing agent 比 direct DOM 操作更强的工程直觉,agent 工具调用设计参考
  • 主题:RL 中 Importance Sampling — PPO 目标函数/训练-推理分布不匹配的技术根因 | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch/status/2098436272855355478 | 仓库:无 | 论文:无 | 硬核点:PPO/异步 RL 中 importance sampling 的核心作用机制,LLM post-training 必懂概念
  • 主题:SAS: Simple Attention Sparsification — attention 前做 context ranking 比事后 pruning 更高效 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2099511334987522298 | 仓库:无 | 论文:https://huggingface.co/papers/2609.13918 | 硬核点:在 LM loss 上训练 selector 而非事后剪枝,长 agent trace 优化新思路

其余线索

  • @omarsar0 — LingBot-World 2.0 Small: 1.3B 世界模型单卡实时运行(robbyant_brain) — 已有仓库 robbyant-brain/LingBot-World-Infinity (2026-07-28 追加)
  • @omarsar0 — YC Paper Club: Harness Engineering 论文集策展 — 值得留档但无 repo
  • @rasbt — DeepSeek-V4.1 encoder-decoder 大改款分析 — 模型结构亮点,但无 repo
  • @maximelabonne — Encoder 从第一性原理被重新发现 — 方向性观察,无具体 repo
  • @maximelabonne — WebGPU browser 内微调 PoC (ngxson/wllama) — 前沿 demo,HF 模型卡路径
  • @omarsar0 — Agent harness survey: Self-Improving Agents(arxiv 2512.24189) — 论文策展,无 repo