HF Daily Papers · 2026-07-12
HF Daily Papers 精选(15 篇,按社区票数排序)
- [117▲] Vidu S1: 一个实时交互式视频生成模型 — https://arxiv.org/abs/2607.03118
- [83▲] 通过深度原生结构推理实现准确、跨学科且透明的结构-性质理解 — https://arxiv.org/abs/2607.07708
- [51▲] 面向机器人操作的视觉-语言-动作模型中的双重潜在记忆 — https://arxiv.org/abs/2607.07608
- [50▲] Video-Oasis: 重新思考视频理解评估 — https://arxiv.org/abs/2603.29616
- [47▲] 为什么我打不开我的抽屉?缓解零样本组合动作识别中由物体驱动的捷径学习问题 — https://arxiv.org/abs/2601.16211
- [46▲] 面向具身智能的 Mixture-of-Experts 视频预训练规模化 — https://arxiv.org/abs/2607.07675
- [29▲] 思想也有基因组:科学谱系推理与基于谱系的创意生成基准测试 — https://arxiv.org/abs/2607.08758
- [29▲] 具备多样化交互的无限世界 — https://arxiv.org/abs/2607.07534
- [26▲] LongE2V: 基于事件的视频扩散模型长时域视频重建、预测与帧插值 — https://arxiv.org/abs/2607.08770
- [26▲] UniClawBench: 面向真实世界任务的主动 Agent 通用基准 — https://arxiv.org/abs/2607.08768
- [26▲] LLM-as-a-Tutor: 面向不可验证强化学习的策略感知 Prompt 适配 — https://arxiv.org/abs/2607.04412
- [17▲] 通过几何感知预训练增强上下文全景生成 — https://arxiv.org/abs/2607.08765
- [16▲] DrugGen 2: 面向药物发现增强的疾病感知语言模型 — https://arxiv.org/abs/2607.08404
- [15▲] JD Oxygen AI Item Center (Oxygen AIIC) V1: 以 LLM/VLM 为核心的工业级商品理解、管理与应用解决方案 — https://arxiv.org/abs/2606.28070
- [14▲] Jet-Long: 基于动态双焦 RoPE 的高效长上下文扩展 — https://arxiv.org/abs/2607.07740