HF Daily Papers · 2026-08-12

HF Daily Papers 精选(15 篇,按社区票数排序)

  • [243▲] BDH-CQ:基于循环潜在推理的上下文学习 — https://arxiv.org/abs/2608.09888
  • [212▲] Macaron-V1:通过自我改进与 Mixture-of-LoRA 迈向开放式持续学习 — https://arxiv.org/abs/2608.09819
  • [116▲] SWE-Bench ProMax:在大规模多语言代码重构任务上评测 Agent — https://arxiv.org/abs/2608.09802
  • [66▲] Ouroboros:通过已审核心进化实现自我演进的前沿代码 Agent — https://arxiv.org/abs/2608.08311
  • [57▲] 无需任何监督的 On-Policy 自蒸馏 — https://arxiv.org/abs/2608.06296
  • [33▲] Motif 3:技术报告 — https://arxiv.org/abs/2608.09119
  • [32▲] 从专有 LLM API 窃取推理轨迹 — https://arxiv.org/abs/2608.09867
  • [32▲] Agent Memory Distillation:利用分层教师记忆赋能小型 LLM Agent — https://arxiv.org/abs/2608.07169
  • [27▲] MatrAIx:使用 83 亿人格化 Agent 模拟世界 — https://arxiv.org/abs/2608.04205
  • [23▲] Sci-VBench:评测科学领域中知识密集与推理密集的视频生成 — https://arxiv.org/abs/2608.09873
  • [22▲] 接下来编辑什么:对话系统中视觉对齐的图像编辑追问建议 — https://arxiv.org/abs/2608.07565
  • [17▲] OasisKV:通过前瞻式稀疏预取将解码内 KV Cache 扩展至超越 HBM — https://arxiv.org/abs/2608.08097
  • [17▲] SPOT:用于 On-Policy 蒸馏的稀疏探针与结果校准 — https://arxiv.org/abs/2608.04419
  • [17▲] 人类认知与行为的小型基础模型 — https://arxiv.org/abs/2608.05224
  • [16▲] DCAS:解耦 CLI Agent 脚手架以在不同脚手架间内化规划能力 — https://arxiv.org/abs/2608.06113