Tom
浏览全部笔记 · 60 篇 · 论文雷达 · Agent / RAG
HF Daily Papers · 2026-08-25
HF Daily Papers 精选(15 篇,按社区票数排序) [258▲] EnvHarness: Awakening Static Worlds for Agent Learning — [115▲] FACET: Preserving Source Intent and Executable State in …
HF Daily Papers · 2026-08-24
HF Daily Papers 精选(15 篇,按社区票数排序) [254▲] EnvHarness:唤醒静态世界以支持 Agent 学习 — [155▲] SemCompBench:视频生成中语义任务完成度的基准评测 — [142▲] Zetta ζ:面向自进化物理智能的高效闭环具身 Harness — [115▲]…
HF Daily Papers · 2026-08-23
HF Daily Papers 精选(15 篇,按社区票数排序) [246▲] EnvHarness: 唤醒静态世界以进行 Agent 学习 — [155▲] SemCompBench: 视频生成中语义任务完成能力的基准评测 — [141▲] Zetta : 面向自进化物理智能的高效闭环具身 Harness — [11…
HF Daily Papers · 2026-08-22
HF Daily Papers 精选(15 篇,按社区票数排序) [235▲] EnvHarness:唤醒静态世界以支持Agent学习 — [155▲] SemCompBench:视频生成中的语义任务完成度基准测试 — [140▲] Zetta ζ:面向自我演化物理智能的高效闭环具身框架 — [114▲] SemaPL…
HF Daily Papers · 2026-08-21
HF Daily Papers 精选(15 篇,按社区票数排序) [154▲] Demystifying Agent Skills: Why They WorkUntil They Don't — [153▲] SemCompBench:视频生成中语义任务完成度的基准评测 — [130▲] Zetta ζ:面向自演化物…
HF Daily Papers · 2026-08-20
HF Daily Papers 精选(15 篇,按社区票数排序) [374▲] StateM:在 TerminalBench 2.1 上通过 Harness 扩展达到 95.3% 原始准确率,或 15 美元的前沿运行 — [143▲] 学习剩余的,而非已掌握的:面向多奖励策略优化的饱和感知优势重加权 — [137▲] …
HF Daily Papers · 2026-08-19
HF Daily Papers 精选(15 篇,按社区票数排序) [130▲] StateM: 在 TerminalBench 2.1 上通过 Harness 扩展达到 95.3% 原始准确率,或以 15 美元完成前沿运行 — [111▲] HarnessEvalW: 智能体化评估视觉世界 — [51▲] VibeWo…
HF Daily Papers · 2026-08-18
HF Daily Papers 精选(15 篇,按社区票数排序) [258▲] 围绕 AI 生成视频攻击真实世界危机事件,我们能否进行有效防御?对检测器、生成器与社交传播的系统性评估 — [147▲] 自监督视觉在策略蒸馏 — [42▲] 超越最终分数:面向长周期 AI 研发 Agent 的系统性评估 — [31▲] …
HF Daily Papers · 2026-08-17
HF Daily Papers 精选(15 篇,按社区票数排序) [253▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — [116▲] AlayaEVOKE:从线性扩展监督到无尽世界 — [102▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — [91▲] Dre…
HF Daily Papers · 2026-08-16
HF Daily Papers 精选(15 篇,按社区票数排序) [252▲] OpenART: 通过开放式环境演化扩展 Agent 红队测试 — [107▲] AlayaEVOKE: 从线性扩展监督到无尽世界 — [94▲] LLMRouter: 用于开发、评估和部署 LLM 路由器的统一基础设施 — [82▲] D…
HF Daily Papers · 2026-08-15
HF Daily Papers 精选(15 篇,按社区票数排序) [252▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — [90▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — [82▲] AlayaEVOKE:从线性扩展监督到无界世界 — [82▲] Mecha…
HF Daily Papers · 2026-08-14
HF Daily Papers 精选(15 篇,按社区票数排序) [184▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — [181▲] ComBodied Agents:以人为中心的 Agentic AI 新范式 — [176▲] SparktoPaper:将研究论文端到端生成建模为可组合 Sk…
HF Daily Papers · 2026-08-13
HF Daily Papers 精选(15 篇,按社区票数排序) [553▲] BDHCQ: 基于循环潜在推理的上下文学习 — [185▲] 无监督的 OnPolicy 自蒸馏 — [173▲] ComBodied Agents: 以人为中心的 Agentic AI 新范式 — [116▲] Agentic 系统中的协…
HF Daily Papers · 2026-08-12
HF Daily Papers 精选(15 篇,按社区票数排序) [243▲] BDHCQ:基于循环潜在推理的上下文学习 — [212▲] MacaronV1:通过自我改进与 MixtureofLoRA 迈向开放式持续学习 — [116▲] SWEBench ProMax:在大规模多语言代码重构任务上评测 Agent …
HF Daily Papers · 2026-08-11
HF Daily Papers 精选(15 篇,按社区票数排序) [68▲] 感知语音的可解释 MEG 解码:驱动检索的皮层源与刺激特征 — [33▲] 从经济智能体到智能体化经济:经济世界模型的系统蓝图 — [32▲] SFT 冲突,RL 共存:LLM 多任务学习的理论与实证分析 — [30▲] DataSpace:…
HF Daily Papers · 2026-08-10
HF Daily Papers 精选(15 篇,按社区票数排序) [223▲] 递归合成用于长周期终局任务 — [85▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — [67▲] OSReward:为跨平台计算机使用 Reward Model 建立标准化评测 — [65▲] 可解释的 MEG 感…
HF Daily Papers · 2026-08-09
HF Daily Papers 精选(15 篇,按社区票数排序) [218▲] 递归合成用于长周期终端任务 — [75▲] AgentOPSD:面向智能体强化学习的递归自蒸馏 — [63▲] ABSeeker:通过答案回溯的信用分配训练长周期搜索智能体 — [60▲] OSReward:为跨平台计算机使用奖励模型建立标…
HF Daily Papers · 2026-08-08
HF Daily Papers 精选(15 篇,按社区票数排序) [212▲] 长程终局任务的递归合成 — [67▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — [61▲] ABSeeker:通过答案回溯式信用分配训练长程搜索 Agent — [52▲] OSReward:为跨平台计算机使用奖…
HF Daily Papers · 2026-08-07
HF Daily Papers 精选(15 篇,按社区票数排序) [55▲] ABSeeker:通过答案回溯信用分配训练长视野搜索 Agent — [45▲] ToolArtist:面向 Agentic 图像生成的工具调用统一多模态模型 — [42▲] 迈向多模态预训练的物理学:知识流、模态协同、早期统一与配方 — […
HF Daily Papers · 2026-08-06
HF Daily Papers 精选(15 篇,按社区票数排序) [85▲] MerchantBench: 面向电商运营长期一致性的 LLM Agent 基准测试 — [77▲] JoyAIVideoEdit: 基于自回归扩散的实时开放式视频编辑 — [73▲] AURORALM: 面向连续潜在扩散语言建模的自编码统一…
HF Daily Papers · 2026-08-05
HF Daily Papers 精选(15 篇,按社区票数排序) [140▲] SwanTale: 面向指令与零样本任务的统一多说话人语音与音频生成 — [127▲] LongHorizonHarness: 面向真实任务的长程 Agent 进阶 — [55▲] DAPD: 双锚点策略蒸馏 — [50▲] 弱到强的 On…
HF Daily Papers · 2026-08-04
HF Daily Papers 精选(15 篇,按社区票数排序) [294▲] QwenUIAgent Technical Report:迈向面向下一代以真实世界为中心的基础 GUI Agent — [73▲] 从 RLVR 到 RLSVR:任务变换诱导开放域 LLM 自我提升的可自验证奖励 — [53▲] 心智世界建…
HF Daily Papers · 2026-08-03
HF Daily Papers 精选(15 篇,按社区票数排序) [292▲] AskChem:以主张为中心的化学文献综述基础设施 — [284▲] QwenUIAgent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent — [257▲] Metis:记忆基础模型 — [168▲] FrontisMA1…
HF Daily Papers · 2026-08-02
HF Daily Papers 精选(15 篇,按社区票数排序) [290▲] AskChem:以声明为中心的化学文献合成基础设施 — [278▲] QwenUIAgent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent — [254▲] Metis:记忆基础模型 — [162▲] FrontisMA1…
HF Daily Papers · 2026-08-01
HF Daily Papers 精选(15 篇,按社区票数排序) [285▲] AskChem:以声明为中心的化学文献合成基础设施 — [265▲] QwenUIAgent 技术报告:迈向下一代以真实世界为中心的 GUI 基础 Agent — [240▲] Metis:记忆基础模型 — [150▲] PhiZero:围…
HF Daily Papers · 2026-07-31
HF Daily Papers 精选(15 篇,按社区票数排序) [141▲] HiFiUMI:仅从高保真 UMI 数据中学习可部署的操控策略 — [120▲] TurboVLA:在 RTX 4090 上以 32 Hz 实时运行、显存占用 <1 GB 的 VisionLanguageAction 模型 — [87▲] …
HF Daily Papers · 2026-07-30
HF Daily Papers 精选(15 篇,按社区票数排序) [134▲] HiFiUMI: 仅从高保真 UMI 数据中学习可部署的操控策略 — [83▲] 相关性的新角色:引导 Agentic 搜索中的语料库交互 — [70▲] 重新思考 OnPolicy 扩散蒸馏中的无分类器引导 — [56▲] ReDesig…
HF Daily Papers · 2026-07-29
HF Daily Papers 精选(15 篇,按社区票数排序) [263▲] Kimi K3:开放前沿智能 — [104▲] JarvisHub:面向 Canvas 原生多模态创意 Agent 的开放框架 — [68▲] 面向机器人学习的 Progress Reward Modeling:全面综述 — [67▲] 从…
HF Daily Papers · 2026-07-28
HF Daily Papers 精选(15 篇,按社区票数排序) [142▲] AREX:面向深度研究的递归自我改进 Agent — [57▲] K12KGraph:用于基准测试与训练教育 LLM 的课程对齐知识图谱 — [50▲] ReferTrack:先指代后跟踪的具身视觉跟踪 — [44▲] 视觉对比自蒸馏 — …
HF Daily Papers · 2026-07-27
HF Daily Papers 精选(15 篇,按社区票数排序) [139▲] AREX: 面向深度研究的递归自我改进 Agent — [58▲] SLAI TRex: 在 Ascend SuperPOD 上对 DeepSeekV4 系列进行全参数后训练 — [57▲] K12KGraph: 用于教育 LLM 基准测试…