HF Daily Papers · 2026-07-11
HF Daily Papers 精选(15 篇,按社区票数排序)
- [108▲] Vidu S1:一个实时交互式视频生成模型 — https://arxiv.org/abs/2607.03118
- [77▲] 通过深度原生结构推理实现准确、跨学科且透明的结构-性质理解 — https://arxiv.org/abs/2607.07708
- [50▲] 视觉-语言-动作模型中的双潜在记忆用于机器人操控 — https://arxiv.org/abs/2607.07608
- [43▲] Video-Oasis:重新思考视频理解的评测方式 — https://arxiv.org/abs/2603.29616
- [42▲] 为什么我打不开抽屉?缓解零样本组合动作识别中由物体驱动的捷径问题 — https://arxiv.org/abs/2601.16211
- [42▲] 扩展混合专家视频预训练以赋能具身智能 — https://arxiv.org/abs/2607.07675
- [26▲] 具备多样化交互的无限世界 — https://arxiv.org/abs/2607.07534
- [25▲] LLM-as-a-Tutor:面向不可验证强化学习的策略感知提示自适应 — https://arxiv.org/abs/2607.04412
- [22▲] UniClawBench:面向真实世界任务主动智能体的通用基准 — https://arxiv.org/abs/2607.08768
- [20▲] 思想亦有基因组:科学谱系推理与谱系驱动思想生成基准 — https://arxiv.org/abs/2607.08758
- [19▲] LongE2V:基于视频扩散模型的长时序事件视频重建、预测与帧插值 — https://arxiv.org/abs/2607.08770
- [14▲] 通过几何感知预训练增强上下文全景生成 — https://arxiv.org/abs/2607.08765
- [14▲] JD Oxygen AI Item Center(Oxygen AIIC)V1:面向商品理解、管理与应用的工业级 LLM/VLM 中心化解决方案 — https://arxiv.org/abs/2606.28070
- [12▲] DrugGen 2:面向药物发现增强的疾病感知语言模型 — https://arxiv.org/abs/2607.08404
- [10▲] 用于智能体强化学习的单轨迹异步优化 — https://arxiv.org/abs/2607.07508