Explainers · 学术推广产出

解读

71 篇 · 选题榜 / 深度解读 / 科普 / 综述 / 视频脚本(学术推广产出)

主题综述 · engineering(2026-08-25)
范围:20260819 ~ 0825 近 7 天 engineering 主分类 + 邻接 llminfra 12 篇 arXiv 综合。聚焦三联位移:长上下文推理内核(FlashPrefill V2)+ 后训练栈蒸馏/遗忘/谱系(AdaPop + Centered Residual + S²VOPD / Simple…
周综述 2026-08-25
主题综述 · rag(2026-08-25)
检索增强生成(RAG)在 2020 年由 Lewis 等人定名以来,沿"端到端管道 → 模块化 → 检索范式多样化 → 智能体化"路径迭代。2026 年 8 月这一截面上的研究热点已不再是"embedding + topk + prompt"三件套本身,而是把检索决策权从管道上升为可学习、可验证、可仲裁的一等公民。三条…
周综述 2026-08-25
主题综述 · agent(2026-08-25)
本棒定位:W5 综述轮换。date +%j = 237,mod 8 = 5 = engineering。promo/surveys/ 下 72 小时内已有 20260825engineering.md / 20260823evaluation.md / 20260823risk.md / 20260822databas…
周综述 2026-08-25
主题综述 · evaluation(2026-08-23)
2026 年的 LLM 评测研究,主线已经从"哪个模型在某 benchmark 上得了多少分"的单点准确率,转到了"我们的评测协议本身是否可信"的方法学反思。这一点在三个尺度上同时发生: (1) 综合维度 —— KDD 2025 接收的《Evaluation and Benchmarking of LLM Agents…
周综述 2026-08-23
主题综述 · risk(2026-08-23)
范围:近 4 周(20260726 → 20260823)LLM / Agent 风险研究主轴,覆盖幻觉、对齐税、隐私泄漏、模型窃取、多智能体安全、护栏 / 评测方法学延革 6 条主线 + frontier lab 主动治理 + 红队工具工业级成熟度两条延伸。 与 813 / 817 / 819 三篇 risk 综述的…
周综述 2026-08-23
主题综述 · database(2026-08-22)
20260817 综述以 TEngineDBV / Nova 双 OLAPnative 向量一等公民 + SIGMOD 2026 Filtered Vector Search 10× 延迟差距 + DBAIOps / DBCooker / Tytan 自治运维闭环 + Agentic Transaction ACID …
周综述 2026-08-22
主题综述 · engineering(2026-08-22)
2026 H2 第一个完整月 engineering 主题被早期版本收编为"工程栈可控性三性叙事(可组合性 + 可观测性 + 可干预性)";822 窗口主线位移可追溯到三条轨迹: 第一条轨迹:推理引擎选型侧的"减法 + 增量"同步发生。减法侧:HuggingFace 821 公告 TGI 进入维护模式(只接受 mino…
周综述 2026-08-22
主题综述 · multimodal(2026-08-21)
本综述聚焦 20260809 → 20260821 窗口的多模态研究。HF Daily 单日 ≈ 6 件 multimodal 主分类候选,立标池双向锚进入 v33 以来首次 8 向并存实测(819)并向 9 向并存预备(821),评测方法学延革第 810 例反方立基础候选全部完成。围绕四条主线:(A) 长视频理解与评…
周综述 2026-08-21
主题综述 · llm-infra(2026-08-21)
⚠️ 窗口双警示:(1)今日 821 spark llminfrae1prep 主棒缺位(沿用 820 18:40 落定棒);(2)CoRun / DASH / HBF Sucks 三件 arXiv 截至本棒尚无 paper_card,按"沿用 + 待建"标记。 承接 20260814 spark 综述「vLLM 0.…
周综述 2026-08-21
主题综述 · evaluation(2026-08-20)
date +%j=232, mod 8 = 0 → agent; surveys 目录近 72h 内 evaluation 主题未覆盖(最近一次 evaluation 综述 20260816,距今 ~96h 超 72h 跳过 → 20260812 evaluation 也已超 72h → 本期 evaluation 是…
周综述 2026-08-20
主题综述 · RAG(2026-08-16 · v2 重写版)
重写说明:v1 三项硬约束失守——(1) 8 篇主稿全 arXiv 8 月批次 v1 预印本,0 篇公开 GitHub / 0 篇公开权重 / 0 篇明示评测脚本;ParliamentRAG(2608.13410)S2 被引 0 + OpenAlex 被引 0 + 影响力被引 0 → "全 0 元数据"高风险;(2) …
周综述 2026-08-16
主题综述 · risk(2026-08-19)
范围:近 3 周(20260729 → 20260819)LLM / Agent 治理层与法律 / 监管 / 经济维度。 与 813 / 817 两篇 risk 综述的差异化:前者走"模型 / 协议 / 系统 / 评测 / 治理"五层栈,后者走"协议 + 工程实现双联 + 评测 + 多模态 + 治理"。本次走"治理层内…
周综述 2026-08-19
主题综述 · engineering(2026-08-15)
承接 809 综述已立的"Harness 自动化演进 + 生产 telemetry 反向校验 + 训练数据合成经济学"三轴基线(10 篇代表性工作,涵盖 Prompt Pattern Catalog / AHE / The Last Harness / RST / Agentic Coding in the Wild …
周综述 2026-08-15
主题综述 · agent(2026-08-18)
本棒定位:W5 综述轮换。date +%j = 230,mod 8 = 6 = database。promo/surveys/ 下 72 小时内已有 20260817database.md,顺延到下一未覆盖主题 → agent。 承接材料:paper_cards/ 719 ~ 818 期间 240+ 张 agent 主…
周综述 2026-08-18
主题综述 · multimodal(2026-08-18)
机制段 4 条 + 工程段 4 条 + ⚠️ 数字核验 5 处:✓ 私域五维(ip/kp/rn/fp/oc)grep 命中数:0 CJK 字数(Python re.findall 含中日韩统一表):3,413 / 实际字节 18,984 / 偏差 < 10% 综合论文:8 篇(arXiv:2608.13489 / 26…
周综述 2026-08-18
主题综述 · llm-infra(2026-08-14 · v2 重写版)
重写说明:v1 版四项硬约束同时失守(1) CJK 超字数上限;(2) 私域话术 22 处;(3) 定时调度物理动作直接写入取题说明;(4) 团队内部分工与版本号内部路径直接出现在正文。v2 全面修正,详见末尾"字数与文件元数据"段。 812 → 814 三天窗口 llminfra 主分类 paper_cards 净增…
周综述 2026-08-14
主题综述 · database(2026-08-17)
20260813 的 database 综述以 Transactional Continuity Kernel(arXiv:2608.11632)+ Cordon(arXiv:2606.17573)+ ElephantAgent(arXiv:2607.01919)+ CockroachDB 三层架构为锚,标志 8 月中…
周综述 2026-08-17
主题综述 · risk(2026-08-17)
范围:近 3 周(20260727 → 20260817)AI Agent 风险主轴;与 813 综述"五层栈横向"做差异化,本次走"协议层 + 工程实现层双联实证 + 评测方法学 + 多模态新盲点"深切路径。 主轴:协议层(Stealing Reasoning Traces / MCP Ecosystem) → 工程…
周综述 2026-08-17
主题综述 · evaluation(2026-08-12)
date +%j=224, mod 8 = 0 → agent; surveys 目录 72h 内已存 7 个非 agent 主题,本期主题按未覆盖顺序顺延至 evaluation 落点(最近一次 evaluation 综述为 20260804,距今 ~187h,超 72h,满足未覆盖条件)。本期窗口:20260804…
周综述 2026-08-12
主题综述 · evaluation(2026-08-16)
date +%j=228, mod 8 = 4 → evaluation; surveys 目录近 72h 内 evaluation 主题未覆盖(最近一次 evaluation 综述 20260812, 距今 ~96h 超 72h),本期主题: evaluation。窗口 20260809 → 0816。 材料: (1…
周综述 2026-08-16
主题综述 · agent(2026-08-15)
本棒定位:W5 综述轮换。date +%j = 227,mod 8 = 3 = multimodal。但 814 已有 multimodal 综述,顺延到下一未覆盖主题 = agent。 承接材料:paper_cards/ 中 719 ~ 815 期间 200+ 张 agent 主分类论文卡 + 两次 web_sear…
周综述 2026-08-15
主题综述 · multimodal(2026-08-14)
承接 810 综述四象限(原生多模态基座 → VLA / 世界模型具身 → 评测 / 生成质量 → 鲁棒性 / 安全),811 ~ 814 这 4 天的多模态研究出现三条合流信号: 1. 世界模型从「视频预测 + 反向动力学」切到「训练期当陪练 + 推理期丢弃」(SimWAM),再推进到「读扩散潜做轨迹预测」(Drea…
周综述 2026-08-14
主题综述 · risk(2026-08-13)
范围:20260727 → 20260813(近 3 周 · risk 主分类与副 risk 论文 + 行业安全治理事件) 主轴:模型层 / 协议层 / 系统层 / 评测层 / 治理层 五层安全栈 + 8 篇代表性论文 + 5 项行业事件 立场:综合 48 篇相关工作写深度综述,不只讲"风险是什么";按"为什么"与"怎…
周综述 2026-08-13
主题综述 · database(2026-08-13)
20260809 的 database 综述把当时一周的图景画成三条正交演化轴——部署形态四象限 / AI4DB 自治 / Agent 记忆合流——并把 9 篇主分类卡片骨架并列读。四天之后的 20260813,这一图景被一组新工作显著改写:数据库内核不再只是 Agent 记忆的存储底座,而是反向输出为 Agent 长…
周综述 2026-08-13
主题综述 · RAG(2026-08-05 · v2 重写版)
重写说明:v1 版定位偏移——本应作为"对 20260805 RAG 主题的独立深度综述",实际却是 R 序列私域节点 16 处 + 团队内实例显式署名 2 处的私域污染叠加(v1 私域污染 SUM = 18,居 805 ~ 812 窗口 15 篇综述第一)。v2 修正:(1) R 序列私域节点脱敏为通用描述;(2) …
周综述 2026-08-05
主题综述 · RAG(2026-08-12)
20260805 的 RAG 综述把主线收束在「七元 Runtime Stack」。七天过去,arXiv 8 月 512 日窗口的 RAGprimary 新工作呈现共同模式:不再往上加模块,而是把 RAG 默认管线里被默认接受多年的隐含假设逐条拆掉重做。本文聚焦 8 篇核心 arXiv 工作——EAHR(2608.07…
周综述 2026-08-12
主题综述 · llm-infra(2026-08-11 · v2 重写版)
重写说明:v1 版四项硬约束同时失守——(1) CJK 超 W32 单篇硬上限 4,000 约 +55%;(2) 私域污染 SUM=12 中含 5 处机构内部任务代号(810 反思"私域清洁度硬约束"四维度 ip+kp+rn+fp 未覆盖 oc 新增维度的检查表漏洞首次受害);(3) W32 第 3 项独立合规段未独立…
周综述 2026-08-11
主题综述 · agent(2026-08-11)
本棒定位:W5 综述轮换。date +%j = 223,223 mod 8 = 7,对应 risk。但 20260810risk.md 已在 23 小时前写就,落入 72 小时窗口。按 cron 规则顺延到下一个未覆盖主题,最近 72 小时已覆盖:engineering (809) / database (809) /…
周综述 2026-08-11
主题综述 · engineering(2026-08-05 · v2 重写版)
重写说明:v1 版定位偏移——本应作为"对 20260805 engineering 主题的独立深度综述",实际却是 6 处 inbox/jay 私域路径 + 12 处团队内实例显式署名 + 16 处活文档 §节点号密集引用 + 私域活文档路径 1 处的私域污染叠加(v1 私域污染 SUM = 34,居 804 ~ 8…
周综述 2026-08-05
主题综述 · multimodal(2026-08-10)
2026 年 78 月的多模态研究已经从「单点架构比拼」过渡到「范式合流」:原生多模态(natively multimodal)、世界模型(world model)与视觉语言动作模型(VLA)三条主线在同一批论文里反复互引。本综述以「开源权重原生多模态基座 → VLA / 世界模型具身 → 多模态评测与生成质量 → 鲁…
周综述 2026-08-10