视频选题榜 2026-07-31
- https://arxiv.org/abs/2607.26784 · SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution · 跨任务技能演化训练范式 method paper · 单策略 solve+curate 双角色 + 解耦信用分配 + 跨任务测试时 scaling 现象 · round=R1
- https://arxiv.org/abs/2607.27136 · KAMR: Knowledge-Aligned Multi-hop Retrieval · RAG 多跳接地 · 锚点 + 桥接双阶段 + 部分对齐监督 + 双层对比学习 · round=R2
- https://arxiv.org/abs/2607.28374 · LEDGERMIND: Provenance-Constrained Multimodal Agentic Reasoning with a Structured Evidence Ledger · 多模态 agent 整条轨迹抽象为来源受限状态机 + SEL 结构化证据账本 + entity/numeric 双层 grounding + provenance non-amplification guarantee 形式化不变量 + 压制四种典型失败模式 · round=R3