AVA-Encoder: Towards Agent-Native Video Representation Learning

  • 类型:arxiv
  • 标识:2608.12313
  • 链接:https://arxiv.org/abs/2608.12313
  • 主分类:agent
  • 形态:method
  • 被引:0
  • 被引来源:Semantic Scholar
  • S2被引:0
  • 影响力被引:0
  • TLDR:The Agentic Video Auto-Encoder (AVA-Encoder), a novel auto-encoding framework driven by agentic self-evolution to learn agent-native video representations that outperforms a carefully human-tuned policy while using 74.3% fewer shot-level and keyframe-level system-prompt tokens.
  • 副分类:multimodal
  • 待LLM分类:否
  • 标题中文:AVA-Encoder:迈向面向 Agent 原生的视频表征学习
  • TLDR中文:提出 Agentic Video Auto-Encoder(AVA-Encoder),一种由 agentic 自我进化驱动的新型自编码框架,用于学习 agent-native 视频表示,在 shot-level 和 keyframe-level system-prompt token 使用量减少 74.3% 的同时,性能优于精心人工调优的策略。
  • 来源文件
  • /inbox/tom/_candidates/2026-08-14-agent-rag-longcontext-candidates.json
  • [S2 enrich]