DAPD: Dual-Anchored Policy Distillation
- 类型:arxiv
- 标识:2608.01735
- 链接:https://arxiv.org/abs/2608.01735
- 主分类:llm-infra
- 形态:method
- 被引:0
- 被引来源:Semantic Scholar + OpenAlex
- S2被引:0
- OpenAlex被引:0
- 影响力被引:0
- TLDR:DAPD is proposed, a unified framework with two levels of anchoring that significantly alleviates privilege illusion, outperforming OPSD on Qwen3-4B by +2.00 points on average across tasks.
- OpenAlex ID:W7172431632
- OpenAlex DOI:10.48550/arxiv.2608.01735
- DOI:10.48550/arxiv.2608.01735
- DOI来源:OpenAlex
- 开放获取:green
- 开放获取链接:https://doi.org/10.48550/arxiv.2608.01735
- OpenAlex更新:2026-08-26
- 副分类:engineering
- 待LLM分类:否
- 标题中文:DAPD:双锚点策略蒸馏
- TLDR中文:本文提出 DAPD,一种具有两级锚定的统一框架,可显著缓解特权错觉,在 Qwen3-4B 上以平均 +2.00 分优于 OPSD。
- 来源文件:
- /inbox/tom/_candidates/2026-08-04-agent-rag-longcontext-candidates.json
- [S2 enrich]
- [OpenAlex backfill]