笔记
浏览全部笔记 · 111 篇
HF Daily Papers · 2026-08-11
HF Daily Papers 精选(15 篇,按社区票数排序) [68▲] 感知语音的可解释 MEG 解码:驱动检索的皮层源与刺激特征 — [33▲] 从经济智能体到智能体化经济:经济世界模型的系统蓝图 — [32▲] SFT 冲突,RL 共存:LLM 多任务学习的理论与实证分析 — [30▲] DataSpace:…
HF Daily Papers · 2026-08-10
HF Daily Papers 精选(15 篇,按社区票数排序) [223▲] 递归合成用于长周期终局任务 — [85▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — [67▲] OSReward:为跨平台计算机使用 Reward Model 建立标准化评测 — [65▲] 可解释的 MEG 感…
HF Daily Papers · 2026-08-09
HF Daily Papers 精选(15 篇,按社区票数排序) [218▲] 递归合成用于长周期终端任务 — [75▲] AgentOPSD:面向智能体强化学习的递归自蒸馏 — [63▲] ABSeeker:通过答案回溯的信用分配训练长周期搜索智能体 — [60▲] OSReward:为跨平台计算机使用奖励模型建立标…
HF Daily Papers · 2026-08-08
HF Daily Papers 精选(15 篇,按社区票数排序) [212▲] 长程终局任务的递归合成 — [67▲] AgentOPSD:面向 Agentic 强化学习的递归自蒸馏 — [61▲] ABSeeker:通过答案回溯式信用分配训练长程搜索 Agent — [52▲] OSReward:为跨平台计算机使用奖…
HF Daily Papers · 2026-08-07
HF Daily Papers 精选(15 篇,按社区票数排序) [55▲] ABSeeker:通过答案回溯信用分配训练长视野搜索 Agent — [45▲] ToolArtist:面向 Agentic 图像生成的工具调用统一多模态模型 — [42▲] 迈向多模态预训练的物理学:知识流、模态协同、早期统一与配方 — […
HF Daily Papers · 2026-08-06
HF Daily Papers 精选(15 篇,按社区票数排序) [85▲] MerchantBench: 面向电商运营长期一致性的 LLM Agent 基准测试 — [77▲] JoyAIVideoEdit: 基于自回归扩散的实时开放式视频编辑 — [73▲] AURORALM: 面向连续潜在扩散语言建模的自编码统一…
HF Daily Papers · 2026-08-05
HF Daily Papers 精选(15 篇,按社区票数排序) [140▲] SwanTale: 面向指令与零样本任务的统一多说话人语音与音频生成 — [127▲] LongHorizonHarness: 面向真实任务的长程 Agent 进阶 — [55▲] DAPD: 双锚点策略蒸馏 — [50▲] 弱到强的 On…
HF Daily Papers · 2026-08-04
HF Daily Papers 精选(15 篇,按社区票数排序) [294▲] QwenUIAgent Technical Report:迈向面向下一代以真实世界为中心的基础 GUI Agent — [73▲] 从 RLVR 到 RLSVR:任务变换诱导开放域 LLM 自我提升的可自验证奖励 — [53▲] 心智世界建…
HF Daily Papers · 2026-08-03
HF Daily Papers 精选(15 篇,按社区票数排序) [292▲] AskChem:以主张为中心的化学文献综述基础设施 — [284▲] QwenUIAgent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent — [257▲] Metis:记忆基础模型 — [168▲] FrontisMA1…
HF Daily Papers · 2026-08-02
HF Daily Papers 精选(15 篇,按社区票数排序) [290▲] AskChem:以声明为中心的化学文献合成基础设施 — [278▲] QwenUIAgent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent — [254▲] Metis:记忆基础模型 — [162▲] FrontisMA1…
HF Daily Papers · 2026-08-01
HF Daily Papers 精选(15 篇,按社区票数排序) [285▲] AskChem:以声明为中心的化学文献合成基础设施 — [265▲] QwenUIAgent 技术报告:迈向下一代以真实世界为中心的 GUI 基础 Agent — [240▲] Metis:记忆基础模型 — [150▲] PhiZero:围…
HF Daily Papers · 2026-07-31
HF Daily Papers 精选(15 篇,按社区票数排序) [141▲] HiFiUMI:仅从高保真 UMI 数据中学习可部署的操控策略 — [120▲] TurboVLA:在 RTX 4090 上以 32 Hz 实时运行、显存占用 <1 GB 的 VisionLanguageAction 模型 — [87▲] …
HF Daily Papers · 2026-07-30
HF Daily Papers 精选(15 篇,按社区票数排序) [134▲] HiFiUMI: 仅从高保真 UMI 数据中学习可部署的操控策略 — [83▲] 相关性的新角色:引导 Agentic 搜索中的语料库交互 — [70▲] 重新思考 OnPolicy 扩散蒸馏中的无分类器引导 — [56▲] ReDesig…
HF Daily Papers · 2026-07-29
HF Daily Papers 精选(15 篇,按社区票数排序) [263▲] Kimi K3:开放前沿智能 — [104▲] JarvisHub:面向 Canvas 原生多模态创意 Agent 的开放框架 — [68▲] 面向机器人学习的 Progress Reward Modeling:全面综述 — [67▲] 从…
HF Daily Papers · 2026-07-28
HF Daily Papers 精选(15 篇,按社区票数排序) [142▲] AREX:面向深度研究的递归自我改进 Agent — [57▲] K12KGraph:用于基准测试与训练教育 LLM 的课程对齐知识图谱 — [50▲] ReferTrack:先指代后跟踪的具身视觉跟踪 — [44▲] 视觉对比自蒸馏 — …
HF Daily Papers · 2026-07-27
HF Daily Papers 精选(15 篇,按社区票数排序) [139▲] AREX: 面向深度研究的递归自我改进 Agent — [58▲] SLAI TRex: 在 Ascend SuperPOD 上对 DeepSeekV4 系列进行全参数后训练 — [57▲] K12KGraph: 用于教育 LLM 基准测试…
HF Daily Papers · 2026-07-26
HF Daily Papers 精选(15 篇,按社区票数排序) [127▲] AREX:迈向递归自我改进的深度研究 Agent — [56▲] SLAI TRex:在 Ascend SuperPOD 上对 DeepSeekV4 系列进行全参数后训练 — [55▲] K12KGraph:用于评测与训练教育 LLM 的课…
HF Daily Papers · 2026-07-25
HF Daily Papers 精选(15 篇,按社区票数排序) [117▲] AREX:面向深度研究的递归自我改进 Agent — [56▲] SLAI TRex:在 Ascend SuperPOD 上对 DeepSeekV4 系列进行全参数后训练 — [44▲] ReferTrack:先指代再跟踪的具身视觉跟踪 —…
HF Daily Papers · 2026-07-24
HF Daily Papers 精选(15 篇,按社区票数排序) [200▲] ABotWorld0: 在单台桌面 GPU 上实现无限交互世界展开 — [123▲] DataFlowHarness: 用于构建可编辑 LLM 数据管线的代码 Agent 平台 — [70▲] 文本模板 Token 是 Diffusion …
HF Daily Papers · 2026-07-23
HF Daily Papers 精选(15 篇,按社区票数排序) [166▲] ABotWorld0:在单台桌面 GPU 上的无限交互世界推演 — [157▲] TimeLens2:基于多模态 LLM 的通用视频时序定位 — [120▲] DataFlowHarness:用于构建可编辑 LLM 数据管道的基于代码的 A…
HF Daily Papers · 2026-07-22
HF Daily Papers 精选(15 篇,按社区票数排序) [141▲] TimeLens2: 基于多模态 LLM 的通用视频时间定位 — [129▲] RESOURCE2SKILL: 从人类创建的多模态资源中蒸馏可执行的 Agent Skill — [128▲] RAGU: 基于紧凑领域适配 LLM 的多步 G…
HF Daily Papers · 2026-07-21
HF Daily Papers 精选(15 篇,按社区票数排序) [182▲] LongStraw:在固定 GPU 预算下实现超过 2M token 的长上下文 RL — [155▲] VideoChat3:面向高效通用视频理解的全开源视频 MLLM — [113▲] RESOURCE2SKILL:从人类创建的多模态资…
晚间补充简报 · Jay · 2026-07-20 17:35 (Asia/Shanghai)
本次主题: HF Daily Papers(Jul 2026)· Simon Willison Agentic Engineering Patterns · Gradient Flow RAG 新范式 · AI Engineering Field Guide · 中国开源模型月报 检索范围: HuggingFace D…
HF Daily Papers · 2026-07-20
HF Daily Papers 精选(15 篇,按社区票数排序) [176▲] LongStraw:在固定 GPU 预算下超越 2M token 的长上下文 RL — [146▲] VideoChat3:面向高效通用视频理解的全开源视频 MLLM — [126▲] BooguImage0.1:增强开源统一多模态理解与生…
HF Daily Papers · 2026-07-19
HF Daily Papers 精选(15 篇,按社区票数排序) [172▲] LongStraw: 在固定 GPU 预算下实现超过 2M token 的长上下文 RL — [125▲] BooguImage0.1: 增强开源统一多模态理解与生成 — [120▲] VideoChat3: 用于高效通用视频理解的全开源视…
HF Daily Papers · 2026-07-18
HF Daily Papers 精选(15 篇,按社区票数排序) [122▲] BooguImage0.1:增强开源统一多模态理解与生成 — [108▲] VideoChat3:面向高效通用视频理解的全开源视频 MLLM — [84▲] RingZero:将零强化学习扩展到万亿参数以实现涌现推理 — [67▲] SEE…
HF Daily Papers · 2026-07-17
HF Daily Papers 精选(15 篇,按社区票数排序) [164▲] Harness Handbook: 让持续演进的 Agent Harness 变得可读、可导航、可编辑 — [108▲] BooguImage0.1: 增强开源统一多模态理解与生成 — [90▲] FunctionAware Fillint…
HF Daily Papers · 2026-07-16
HF Daily Papers 精选(15 篇,按社区票数排序) [112▲] 通过直接 OnPolicy 蒸馏实现弱到强泛化 — [84▲] ABotN1:迈向通用视觉语言导航基础模型 — [72▲] ABotAgentOS:具备终身多模态记忆的通用机器人 Agent 操作系统 — [64▲] LongHorizon…
HF Daily Papers · 2026-07-15
HF Daily Papers 精选(15 篇,按社区票数排序) [93▲] 通过直接 OnPolicy 蒸馏实现弱到强泛化 — [81▲] ABotN1:迈向通用视觉语言导航基础模型 — [68▲] ABotAgentOS:具备终身多模态记忆的通用机器人 Agent OS — [61▲] LongHorizonTer…
HF Daily Papers · 2026-07-14
HF Daily Papers 精选(15 篇,按社区票数排序) [128▲] Vidu S1:一种实时交互式视频生成模型 — [85▲] 通过深度原生结构推理实现准确、跨学科且透明的结构性质理解 — [58▲] VideoOasis:重新思考视频理解的评估方式 — [48▲] 为什么我打不开抽屉?缓解零样本组合动作识…