HF Daily Papers · 2026-09-05
HF Daily Papers 精选(15 篇,按社区票数排序)
- [256▲] Compile by Training:将自然语言规约转化为局部神经函数 — https://arxiv.org/abs/2609.04199
- [213▲] Terminal-Universe:将 Agent 轨迹转化为可扩展的终端环境 — https://arxiv.org/abs/2609.04148
- [196▲] LLaDA-Image:以完全开放的训练方案构建强大的图像生成器 — https://arxiv.org/abs/2609.03796
- [146▲] 知晓何时不复用:自主 LLM 后训练中的条件经验迁移 — https://arxiv.org/abs/2608.26730
- [123▲] Random Attention:重新思考高效推理的 KV Cache 淘汰策略 — https://arxiv.org/abs/2609.03430
- [102▲] LatentPress:超越文本与视觉的上下文压缩 — https://arxiv.org/abs/2609.01507
- [66▲] 为何 Gated DeltaNet 能扛住 4-bit 量化:混合 27B LLM 中循环部分的 NVFP4 W4A4 — https://arxiv.org/abs/2609.04098
- [65▲] 重新思考大语言模型的 On-Policy 蒸馏 II:单个训练样本 — https://arxiv.org/abs/2609.04172
- [59▲] Puffin-World:以原生 3D 世界状态扩展统一多模态模型 — https://arxiv.org/abs/2609.04196
- [34▲] Scal3R:学习高效的多相对位姿查询以实现可扩展的在线 3D 重建 — https://arxiv.org/abs/2609.04201
- [32▲] 可编辑的视觉设计 — https://arxiv.org/abs/2609.04034
- [29▲] WHALE:联合 Harness-Weight 优化的简洁配方 — https://arxiv.org/abs/2609.00196
- [26▲] 缺失的时间纽带:脚本驱动音视频生成中的时间上下文路由 — https://arxiv.org/abs/2609.02367
- [26▲] 超越视觉相似度:基于知识的视觉问答中的实体对齐检索 — https://arxiv.org/abs/2608.21450
- [24▲] NeoMME:用于高效微调与推理的单塔多模态原生多语言基础编码器 — https://arxiv.org/abs/2609.01657