信源:X 硬核干货雷达 · 覆盖 12 账号
干货候选
- 主题:LLM 如何在低/中/高推理努力之间切换——训练与推理时机制详解 | 来源:@rasbt | 链接:https://x.com/rasbt/status/2078471977237450829 | 仓库:无 | 论文:无 | 硬核点:277.9K 阅读,附训练过程可视化;覆盖 test-time scaling、effort level 实现路径与训练数据构造,实操性强
- 主题:Agent 训练中加入 World Modeling 如何提升性能:Joint RL+SFT、Observation 过滤、过拟合处理、成本分析 | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch/status/2079214560943198614 | 仓库:无 | 论文:https://arxiv.org/abs/2605.24517 (ECHO) | 硬核点:博客全文摘要,涵盖 ECHO/PaW/Qwen-AgentWorld 三篇论文联读,系统梳理 RL + World Modeling 联合训练方法论
- 主题:LLM 论文分享——On-Policy 蒸馏比静态标签转移更优,学生从自身 Rollout 中学习弱教师策略 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2077170804693803266 | 仓库:无 | 论文:https://arxiv.org/abs/2605.09614 (Direct On-Policy Distillation) | 硬核点:弱到强泛化新分支,on-policy 避免错误全局记忆,关键看能力差距变大后是否持续有效
- 主题:LlamaParse Retrieval Harness 发布——混合检索 + File Grep + File Read 三工具协同,2026 版 RAG Agentic Pipeline | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2071729856900215261 | 仓库:无 | 论文:无 | 硬核点:Jerry Liu 亲自详解四工具设计动机;alpha 值动态切换向量/关键词检索是实操关键,附代码工具链示意
- 主题:Sakana AI Conductor 7B SOTA 原理——RL 训练 Orchestrator 学习通信拓扑 + 递归自选 worker,测试时 Scaling 新范式 | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2051306659021242635 | 仓库:无 | 论文:https://arxiv.org/abs/2512.04388 | 硬核点:3% 提升对应 SOTA 一代版本差但来自协同而非预训练;Orchestrator 即模型,路由是可学习策略
其余线索
- 主题:Anthropic 隐私政策"验证数据"条款 6/8 发布、7/8 生效,与 Fable 5 发布、出口禁令时间线对齐分析 | 来源:@simonw | 链接:https://x.com/simonw/status/2066541206402969672 | 仓库:无 | 论文:无 | 硬核点:收集证件图像、面部几何模板等生物特征数据的具体条款;可作合规/风控攻略素材
- 主题:DataFlow-Harness 代码 Agent 平台——为 LLM 数据流水线构建可编辑评测环境,支持 Agent 交互式构建数据管道 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2079980796782236046 | 仓库:无 | 论文:https://arxiv.org/abs/2605.11920 | 硬核点:平台 paper 分享,Grounded Code Agent 方向,适合标注为技术追踪
- 主题:Tripo AI Project Eden 世界模型架构——先建 Map 再渲染,解决帧级生成模型"遗忘"问题,物体多视角一致性突破 | 来源:@svpino | 链接:https://x.com/svpino/status/2069846836270211514 | 仓库:无 | 论文:无 | 硬核点:Map-first 架构解析;持久化世界状态、多人共存、实时编辑的技术路径,3D/Embodied AI 值得关注