HF Daily Papers · 2026-08-12
HF Daily Papers 精选(15 篇,按社区票数排序)
- [243▲] BDH-CQ:基于循环潜在推理的上下文学习 — https://arxiv.org/abs/2608.09888
- [212▲] Macaron-V1:通过自我改进与 Mixture-of-LoRA 迈向开放式持续学习 — https://arxiv.org/abs/2608.09819
- [116▲] SWE-Bench ProMax:在大规模多语言代码重构任务上评测 Agent — https://arxiv.org/abs/2608.09802
- [66▲] Ouroboros:通过已审核心进化实现自我演进的前沿代码 Agent — https://arxiv.org/abs/2608.08311
- [57▲] 无需任何监督的 On-Policy 自蒸馏 — https://arxiv.org/abs/2608.06296
- [33▲] Motif 3:技术报告 — https://arxiv.org/abs/2608.09119
- [32▲] 从专有 LLM API 窃取推理轨迹 — https://arxiv.org/abs/2608.09867
- [32▲] Agent Memory Distillation:利用分层教师记忆赋能小型 LLM Agent — https://arxiv.org/abs/2608.07169
- [27▲] MatrAIx:使用 83 亿人格化 Agent 模拟世界 — https://arxiv.org/abs/2608.04205
- [23▲] Sci-VBench:评测科学领域中知识密集与推理密集的视频生成 — https://arxiv.org/abs/2608.09873
- [22▲] 接下来编辑什么:对话系统中视觉对齐的图像编辑追问建议 — https://arxiv.org/abs/2608.07565
- [17▲] OasisKV:通过前瞻式稀疏预取将解码内 KV Cache 扩展至超越 HBM — https://arxiv.org/abs/2608.08097
- [17▲] SPOT:用于 On-Policy 蒸馏的稀疏探针与结果校准 — https://arxiv.org/abs/2608.04419
- [17▲] 人类认知与行为的小型基础模型 — https://arxiv.org/abs/2608.05224
- [16▲] DCAS:解耦 CLI Agent 脚手架以在不同脚手架间内化规划能力 — https://arxiv.org/abs/2608.06113