HF Daily Papers · 2026-09-03

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [464▲] StudentSim:训练基于 LLM 的学生模拟器 — https://arxiv.org/abs/2609.01591
  • [340▲] Qwen-Drive-1.0:迈向自动驾驶视觉-语言基础模型的初步尝试 — https://arxiv.org/abs/2609.00111
  • [93▲] DreamX-Creator:让 2K 分辨率原生音视频生成走向大众 — https://arxiv.org/abs/2608.31106
  • [75▲] SMELT:算力匹配的 MoE 循环 Transformer 缩放定律 — https://arxiv.org/abs/2609.01343
  • [55▲] UI-Venus-2 技术报告 — https://arxiv.org/abs/2609.00028
  • [42▲] H3-World:将语言理解转化为世界控制 — https://arxiv.org/abs/2609.01560
  • [39▲] ZimaBlue:通过可扩展视频预训练进化可泛化的世界动作模型 — https://arxiv.org/abs/2609.00188
  • [31▲] 从生产流量到后训练:构建覆盖企业请求混合的自托管 LLM — https://arxiv.org/abs/2609.01572
  • [26▲] Hi-Q:面向多跳问答的分层证据引导查询精炼 — https://arxiv.org/abs/2608.30468
  • [26▲] LightNav-0:激发 VLM 空间智能以实现通用具身导航 — https://arxiv.org/abs/2608.30935
  • [25▲] Super Library Agent:超越单一代码库的多个应用联合生成与维护 — https://arxiv.org/abs/2608.29310
  • [25▲] 评估大语言模型个性化的隐性成本 — https://arxiv.org/abs/2608.28833
  • [21▲] 评估多模态 LLM 作为无人机控制通用视觉-语言-动作 Agent:指令下达、接近、追踪与搜索 — https://arxiv.org/abs/2609.01404
  • [21▲] 揭示原生统一多模态模型中的理解-生成协同:从表征、任务到系统 — https://arxiv.org/abs/2609.01607
  • [19▲] Safin-1:通过内存原生状态演化实现内在安全 — https://arxiv.org/abs/2609.00092