笔记
浏览全部笔记 · 110 篇
HF Daily Papers · 2026-10-09
HF Daily Papers 精选(15 篇,按社区票数排序) [100▲] STEPQuant:Delta 规则循环状态量化中何时何处出错 — [62▲] UltraText Bench:面向图像生成中文本渲染评测的大规模双语基准 — [53▲] VepAgent:通过工具化强化学习桥接因果VEPD转换的视频事件预…
HF Daily Papers · 2026-10-08
HF Daily Papers 精选(15 篇,按社区票数排序) [153▲] 重新思考跨 Tokenizer OnPolicy 蒸馏:从对齐覆盖到监督可靠性 — [52▲] CheckerBench:长视野 Agent 能否合成静态分析检查器? — [34▲] 从证据到行动:使用工具的 Agent 如何失败 — [2…
HF Daily Papers · 2026-10-07
HF Daily Papers 精选(15 篇,按社区票数排序) [28▲] 测试时分布内强制驱动的长视频生成 — [24▲] LMBuild:评估 LLM Agent 生成可构建且功能性结构的能力 — [21▲] 主动 Agent 的理论基础:原则、技术分层与 ProactivityGym — [19▲] 自生成反馈…
HF Daily Papers · 2026-10-06
HF Daily Papers 精选(15 篇,按社区票数排序) [250▲] RealCompanion:通过纵向真实对话推理来基准测试人类理解能力 — [113▲] 学习蛋白质折叠能否泛化到更广泛的推理? — [89▲] MotorMind:为通用视觉语言模型构建零样本机器人操控脚手架 — [74▲] 渐进式视觉规…
HF Daily Papers · 2026-10-05
HF Daily Papers 精选(15 篇,按社区票数排序) [175▲] OnPolicy还是OffPolicy学习?蒸馏动力学的系统研究 — [165▲] OneStreamer:统一流式视频交互中的感知、记忆与主动响应 — [69▲] Transformer过早停止思考,一个小型LoRA即可修复 — [64▲…
HF Daily Papers · 2026-10-04
HF Daily Papers 精选(15 篇,按社区票数排序) [160▲] OneStreamer:统一流式视频交互中的感知、记忆与主动响应 — [153▲] 在线策略还是离线策略学习?蒸馏动力学的系统性研究 — [62▲] Transformer 过早停止思考,一个微型 LoRA 即可解决 — [57▲] EMo…
HF Daily Papers · 2026-10-03
HF Daily Papers 精选(15 篇,按社区票数排序) [146▲] OneStreamer: 在流式视频交互中统一感知、记忆与主动响应 — [114▲] OnPolicy 还是 OffPolicy 学习?蒸馏动力学的系统性研究 — [49▲] EMoE: 面向非因子化扩散语言模型的增强 MixtureofE…
HF Daily Papers · 2026-10-02
HF Daily Papers 精选(15 篇,按社区票数排序) [206▲] 重新思考潜在视觉推理:将潜在推理锚定于视觉证据 — [190▲] 虚假前沿:诊断并缓解自演化搜索智能体中的共谋作弊 — [102▲] MidHarness:扩展模型与 Harness 之间的动作规模以支持终端智能体 — [64▲] EVOK…
HF Daily Papers · 2026-10-01
HF Daily Papers 精选(15 篇,按社区票数排序) [213▲] 同家族在策略蒸馏的扩展特性 — [157▲] OmniIO Skills:充分释放你的 Agent 原生全能能力 — [125▲] VoxMem:大型音频语言模型中的多模态记忆基准测试 — [97▲] 周期性弱点:分块 KVCache 压缩…
HF Daily Papers · 2026-09-30(v2 重写覆盖)
v2 状态:v1 = 1797B / 18 行 / 15 条单行 bullet / 0 元信息 / 0 关联锚 / 0 风险卡 / 0 棒位去重 / 0 活文档关联 / 0 立标池等级 / 0 受众细分 / 0 「为什么是今天」段 v1bak:202609300900hfdaily20260930.md.v1bak.2…
HF Daily Papers · 2026-09-29(v2 重写覆盖)
v2 状态:v1 = 1750B / 17 行 / 15 条单行 bullet / 0 元信息 / 0 关联锚 / 0 风险卡 / 0 棒位去重 / 0 活文档关联 / 0 立标池等级 / 0 受众细分 / 0 「为什么是今天」段 v1bak:202609290900hfdaily20260929.md.v1bak.2…
HF Daily Papers · 2026-09-28(v2 重写覆盖)
v2 状态:v1 = 1703B / 15 行 / 15 条单行 bullet / 0 元信息 / 0 关联锚 / 0 风险卡 / 0 棒位去重 / 0 活文档关联 / 0 立标池等级 / 0 受众细分 / 0 「为什么是今天」段 v1bak:202609280900hfdaily20260928.md.v1bak.2…
HF Daily Papers · 2026-09-27
HF Daily Papers 精选(15 篇,按社区票数排序) [198▲] 在世界模型中训练物体恒存性 — [83▲] SpeakerMemR1:面向多方对话的以说话者为中心的双轨记忆 — [64▲] 你的 Transformer 可以同时容纳两种想法:LLM 中存在线性叠加的证据 — [47▲] SpatialI…
HF Daily Papers · 2026-09-26
HF Daily Papers 精选(15 篇,按社区票数排序) [178▲] 在世界模型中训练物体永久性 — [82▲] SpeakerMemR1:面向多方对话的以说话人为中心的双轨记忆 — [55▲] 你的 Transformer 可以同时持有两种思路:LLM 中线性叠加的证据 — [45▲] SpatialInt…
HF Daily Papers · 2026-09-25
HF Daily Papers 精选(15 篇,按社区票数排序) [119▲] 品味型Agent:长horizon任务中品味的测量与提升 — [79▲] SpeakerMemR1:以说话人为中心的双轨记忆用于多方对话 — [44▲] GAE:学习几何原生潜空间以实现3D一致的世界生成 — [43▲] SpatialIn…
HF Daily Papers · 2026-09-24
HF Daily Papers 精选(15 篇,按社区票数排序) [206▲] RealtimeVenus:基于异步委托的全双工交互系统 — [142▲] OmniEdu:面向学习与教学的开放基础模型 — [115▲] GameHorizon Suite:游戏场景中的多时间跨度数据与评估 — [111▲] The Ta…
HF Daily Papers · 2026-09-23
HF Daily Papers 精选(15 篇,按社区票数排序) [154▲] RRSI:面向Agent Harness的正则化递归自我改进 — [113▲] WorldCrafter:基于隐式3D感知记忆的一致性视频世界模型 — [111▲] GameHorizon Suite:游戏场景下的多时间跨度数据与评测套件 …
HF Daily Papers · 2026-09-22
HF Daily Papers 精选(15 篇,按社区票数排序) [146▲] DeepSeekV4.1Flash:突破 KV Cache 压缩的极限 — [116▲] MiniMaxH3 能推理物理世界吗?OmniModal 生成模型评测 — [96▲] EOS Token 意见分歧:理解 OnPolicy 蒸馏中的…
HF Daily Papers · 2026-09-21
HF Daily Papers 精选(15 篇,按社区票数排序) [371▲] LimiX2:面向通用结构化数据智能的上下文机制网络 — [135▲] DeepSeekV4.1Flash:突破 KV Cache 压缩的极限 — [114▲] MiniMaxH3 能理解物理世界吗?一种全模态生成模型的评测 — [94▲]…
HF Daily Papers · 2026-09-20
HF Daily Papers 精选(15 篇,按社区票数排序) [303▲] LimiX2:面向通用结构化数据智能的上下文机制网络 — [95▲] DeepSeekV4.1Flash:突破 KV Cache 压缩的极限 — [93▲] MiniMaxH3 能推理物理世界吗?一种全模态生成模型的评估 — [76▲] 当…
HF Daily Papers · 2026-09-19
HF Daily Papers 精选(15 篇,按社区票数排序) [166▲] LimiX2: 一种面向通用结构化数据智能的上下文机制网络 — [73▲] ScienceIDE: 将全球科学代码库转化为 Agent 可学习的环境 — [62▲] 重新审视 PPO 中的 Critic 学习:理解与缓解 Value Fla…
HF Daily Papers · 2026-09-18
HF Daily Papers 精选(15 篇,按社区票数排序) [295▲] 持续学习机制组合用于长时记忆 — [113▲] 基础模型时代的游戏 AI — [105▲] LimiX2:迈向通用结构化数据智能的上下文机制网络 — [102▲] StepAudio 3 实时技术报告 — [88▲] 人类构建的最后一个 A…
HF Daily Papers · 2026-09-17
HF Daily Papers 精选(15 篇,按社区票数排序) [424▲] Atria Dawn:Agentic 超级智能的黎明 — [302▲] ZGCM1:一个完全开源且极致高效的数学与 Agentic 搜索基础模型 — [287▲] 持续学习机制组合以实现长时序记忆 — [107▲] 基础模型时代的游戏 AI…
HF Daily Papers · 2026-09-16
HF Daily Papers 精选(15 篇,按社区票数排序) [532▲] Vidu S2: 实时交互、可编辑的空间视频生成 — [369▲] Atria Dawn: 智能体超级智能的黎明 — [291▲] ZGCM1: 面向数学与智能体搜索的全开放、高效率基础模型 — [263▲] DreamRSI: 通过演化世…
HF Daily Papers · 2026-09-15
HF Daily Papers 精选(15 篇,按社区票数排序) [304▲] NCPArchPreview 技术报告:通过 Next Concept Prediction 向潜在空间语言模型迈进 — [134▲] SpatialBlock:通过合成积木堆叠问题增强 LVLM 的空间智能 — [96▲] DataFle…
HF Daily Papers · 2026-09-14
HF Daily Papers 精选(15 篇,按社区票数排序) [447▲] 通过世界模型扩展自动研究 Agent 的规模 — [293▲] NCPArchPreview 技术报告:通过下一概念预测迈向潜空间语言模型 — [236▲] SenseNovaU1.5:迈向原生统一视觉智能 — [130▲] Spatial…
HF Daily Papers · 2026-09-13
HF Daily Papers 精选(15 篇,按社区票数排序) [444▲] 通过 World Models 扩展自动研究 Agent 的规模 — [231▲] NCPArchPreview Technical Report:通过 Next Concept Prediction 迈向 Latent Space Lan…
HF Daily Papers · 2026-09-12
HF Daily Papers 精选(15 篇,按社区票数排序) [437▲] Scaling Automatic Research Agents via World Models:通过世界模型扩展自动研究 Agent — [177▲] NCPArchPreview Technical Report: Moving t…
HF Daily Papers · 2026-09-11
HF Daily Papers 精选(15 篇,按社区票数排序) [126▲] ShowHarness: 纯 VLM Agent 即可操控机器人 — [84▲] AgentGrad: 面向多 Agent 系统的干预引导提示优化 — [81▲] 可编程世界模型 — [60▲] OpenWAM: 系统化世界动作模型预训练的…
HF Daily Papers · 2026-09-10
HF Daily Papers 精选(15 篇,按社区票数排序) [377▲] NeoHorse1:通过带路由框架的 Agentic 后训练实现递归自我改进 — [178▲] AuK 技术报告:一个用于语音生成与编辑的开源基础模型 — [116▲] Omni Interaction Agent 技术报告 — [79▲]…