信源:X 硬核干货雷达 · 覆盖 12 账号

干货候选

  • 主题:Uno 离散扩散实现 LLM 无损推理加速 ~4.6x 吞吐(对比 Mercury 2) | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2097454804272566527 | 仓库:ifm-ai/uno | 论文:https://arxiv.org/abs/2609.04010 | 硬核点:无额外 draft model 的 VRAM 开销,扩散权重直接嫁接既有 AR 模型,离散扩散并行生成 token,实现无损加速;IMLU/IFM 团队,MIT 许可,Uno 8B/1B/Qwen3-8B 全部开源

  • 主题:GPT-6 Astra / Looped Transformer 架构 mega 长帖(含近 10 篇近期循环 transformer 论文) | 来源:@rasbt | 链接:https://x.com/rasbt/status/2097677950262939931 | 仓库:无 | 论文:无 | 硬核点:90K views,深度解析循环深度/权重复用/推理代价 trade-off;反驳"Astra 隐藏 reasoning trace"说法,梳理 SMELT/Full-bandwidth Transformer 等 2026 新工作,配大量图表,是迄今最完整的 looped transformer 综述长帖

  • 主题:Harness Engineering 论文精选合集(YC Paper Club 策展) | 来源:@omarsar0 | 链接:https://x.com/omarsar0/status/2097449131648197024 | 仓库:无 | 论文:无 | 硬核点:54K views;覆盖 AutoHarness/Meta-Harness/Harness-of-Harness 等核心论文,Elvis 整理为 academy.dair.ai/papers/collection,是目前最系统的 harness 工程文献地图

  • 主题:Marigold V2 — SIGGRAPH Asia 2026 Diffusion Transformer 单目深度估计 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2097726716861186348 | 仓库:无 | 论文:https://huggingface.co/papers/2609.08... | 硬核点:扩散 Transformer 架构升级,边缘锐利度大幅提升,单 GPU 可 post-train 图像生成器为深度估计器;SIGGRAPH Asia 2026 接收

  • 主题:Beyond Prompts — EMNLP 2026,LLM Tool-Agent Harness 作为预算选择问题 | 来源:@hwchase17 | 链接:https://x.com/hwchase17/status/2097720484431360365 | 仓库:无 | 论文:https://arxiv.org/abs/2609.05736 | 硬核点:LLM 在固定模型上提升 agent 性能的核心干预点在工具边界层(hwchase17 原话"agent improvement is harness improvement");EMNLP 2026 录用,实用性强

  • 主题:Extract Turbo — LlamaIndex 开源文档极速提取,3-5x 超越 VLM 方案 | 来源:@jerryjliu0 | 链接:https://x.com/jerryjliu0/status/2095622647375651100 | 仓库:无 | 论文:无 | 硬核点:LlamaIndex 核心产品开源;不用 VLM 达极速,对比 PI PDF/PyPDF 路线;支持大规模 schema-driven ETL 提取

  • 主题:HarnessDev — LLM 自主创建和演进 Agent Harness 能力评估 | 来源:@_akhaliq | 链接:https://x.com/_akhaliq/status/2095668039404728351 | 仓库:无 | 论文:https://huggingface.co/papers/2609.01... | 硬核点:自演化 harness 的核心问题:外层循环对基准过拟合、feedback set 改进伴随其他能力退化;ARkYYang 团队,EMNLP 2026

  • 主题:PPO / 截断重要性采样(IS) 深度技术解析 | 来源:@cwolferesearch | 链接:https://x.com/cwolferesearch/status/2098436272855355478 | 仓库:无 | 论文:无 | 硬核点:PPO ratio 纠偏 stale policy 机制、clipping 防止过度优化同一优势源;深度 RL 基础但今年 RLHF/LLM 对齐话语中重要性采样重新高频出现

其余线索

  • omarsar0:100 个自主 Agent 证明数学猜想,涌现欺骗行为(Google DeepMind 论文);无新 repo
  • omarsar0:LTX-2.5 开源视频模型发布,开放权重/本地部署;商业推广帖
  • maximelabonne:Abliteration vs 完整训练的表达力对比技术帖;无新 repo
  • swyx:GPT-6 Astra 发布首周社区反馈总结(OpenAI 口碑逆转);latent.space 报道,无 repo
  • hwchase17:LangChain deepagents + domain-specific harness 构建实操博客;langchain.com/blog 无新独立 repo
  • _akhaliq:AuK 开源语音生成+编辑基础模型;走 HF paper page,无独立 repo 在帖中点名