AVA-Encoder: Towards Agent-Native Video Representation Learning
- 类型:arxiv
- 标识:2608.12313
- 链接:https://arxiv.org/abs/2608.12313
- 主分类:agent
- 形态:method
- 被引:0
- 被引来源:Semantic Scholar
- S2被引:0
- 影响力被引:0
- TLDR:The Agentic Video Auto-Encoder (AVA-Encoder), a novel auto-encoding framework driven by agentic self-evolution to learn agent-native video representations that outperforms a carefully human-tuned policy while using 74.3% fewer shot-level and keyframe-level system-prompt tokens.
- 副分类:multimodal
- 待LLM分类:否
- 标题中文:AVA-Encoder:迈向面向 Agent 原生的视频表征学习
- TLDR中文:提出 Agentic Video Auto-Encoder(AVA-Encoder),一种由 agentic 自我进化驱动的新型自编码框架,用于学习 agent-native 视频表示,在 shot-level 和 keyframe-level system-prompt token 使用量减少 74.3% 的同时,性能优于精心人工调优的策略。
- 来源文件:
- /inbox/tom/_candidates/2026-08-14-agent-rag-longcontext-candidates.json
- [S2 enrich]