HF Daily Papers · 2026-09-06

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [310▲] 通过训练编译:将自然语言规约转化为局部神经函数 — https://arxiv.org/abs/2609.04199
  • [265▲] Terminal-Universe:将 Agent 轨迹转化为可扩展的终端环境 — https://arxiv.org/abs/2609.04148
  • [222▲] LLaDA-Image:以完全开放的训练流程构建强大的图像生成器 — https://arxiv.org/abs/2609.03796
  • [159▲] Random Attention:重新思考 KV Cache 淘汰以实现高效推理 — https://arxiv.org/abs/2609.03430
  • [149▲] 何时不复用:自主 LLM 后训练中的条件经验迁移 — https://arxiv.org/abs/2608.26730
  • [108▲] LatentPress:超越文本与视觉的上下文压缩 — https://arxiv.org/abs/2609.01507
  • [79▲] RoboTok:面向人类演示检索与灵巧操作学习的互联网规模数据引擎 — https://arxiv.org/abs/2609.03199
  • [74▲] 重新思考大语言模型的 On-Policy 蒸馏 II:一个训练样本 — https://arxiv.org/abs/2609.04172
  • [73▲] 为何 Gated DeltaNet 能承受 4-bit 量化:面向混合 27B LLM 循环侧的 NVFP4 W4A4 — https://arxiv.org/abs/2609.04098
  • [65▲] Puffin-World:以原生 3D 世界状态扩展统一多模态模型 — https://arxiv.org/abs/2609.04196
  • [45▲] Scal3R:学习高效多相对位姿查询以实现可扩展的在线三维重建 — https://arxiv.org/abs/2609.04201
  • [40▲] 可编辑的视觉设计 — https://arxiv.org/abs/2609.04034
  • [33▲] 缺失的时间线索:脚本驱动音视频生成中的时间上下文路由 — https://arxiv.org/abs/2609.02367
  • [30▲] WHALE:联合 Harness-Weight 优化的简洁方案 — https://arxiv.org/abs/2609.00196
  • [29▲] 超越检索:面向流式视频理解的渐进式潜在记忆演化 — https://arxiv.org/abs/2609.04131