HF Daily Papers · 2026-07-19
HF Daily Papers 精选(15 篇,按社区票数排序)
- [172▲] LongStraw: 在固定 GPU 预算下实现超过 2M token 的长上下文 RL — https://arxiv.org/abs/2607.14952
- [125▲] Boogu-Image-0.1: 增强开源统一多模态理解与生成 — https://arxiv.org/abs/2607.13125
- [120▲] VideoChat3: 用于高效通用视频理解的全开源视频 MLLM — https://arxiv.org/abs/2607.14935
- [90▲] Ring-Zero: 将 Zero RL 扩展到万亿参数以实现涌现推理 — https://arxiv.org/abs/2607.12395
- [83▲] SEED: 用于智能体强化学习的自演进 On-Policy 蒸馏 — https://arxiv.org/abs/2607.14777
- [58▲] SearchOS-V1: 迈向鲁棒的开放域信息检索智能体协作 — https://arxiv.org/abs/2607.15257
- [44▲] BadWAM: 当世界-动作模型想得对却做错时 — https://arxiv.org/abs/2607.15207
- [38▲] AgentCompass: 智能体能力的统一评估基础设施 — https://arxiv.org/abs/2607.13705
- [35▲] KeyFrame-Compass: 迈向关键帧条件视频生成的全面评估 — https://arxiv.org/abs/2607.14202
- [35▲] PolicyShiftGuard: 策略自适应图像护栏的基准测试与改进 — https://arxiv.org/abs/2607.05910
- [33▲] MetaView: 基于尺度感知隐式几何先验的单目新视角合成 — https://arxiv.org/abs/2607.12000
- [31▲] MultiRef-Compass: 迈向多参考音视频生成的全面评估 — https://arxiv.org/abs/2607.14189
- [28▲] UniVR: 在视觉空间中思考以实现统一视觉推理 — https://arxiv.org/abs/2607.12800
- [27▲] 从像素到状态: 将交互式世界模型重新思考为游戏引擎 — https://arxiv.org/abs/2607.14076
- [27▲] 并发图像理解与生成: 自校正耦合马尔可夫跳跃过程 — https://arxiv.org/abs/2607.13188