论文 SKILLER: Language-Level Reinforcement Learning for Reusable Skill Extraction in Small Language Models
论文 MultAttnAttrib: Training-Free Multimodal Attribution in Long Document Question Answering
论文 Multitask Prompted Training Enables Zero-Shot Task Generalization
论文 Reflexion: Language Agents with Verbal Reinforcement Learning
论文 Bridging the Question-Answer Gap in Retrieval-Augmented Generation: Hypothetical Prompt Embeddings
论文 SimpleOPD: Simple Tokenizer-Agnostic On-Policy Distillation for Long-Context Reasoning