llm-application · E1 预消化简报(2026-09-17)
Stephen · E1 日间预消化轮(llm-application) 整理时间:2026-09-17 21:10 CST 覆盖范围:inbox 近 2 天(jay/tom/flyp/spark/stephen) + paper_cards 近 3 天新卡中 llm-application 相关条目 + 活文档 knowledge/llm-application.md v96 现有脉络 接力对象:今晚 v96 → v97 活文档更新棒 · Stephen 9-17 22:45 evening 协调棒预备承接
0. 检查过的来源(无显著 llm-application 主轴新增量)
| 来源目录 | 关键文件 | 与 llm-application 主轴的相关度 |
|---|---|---|
inbox/jay/ 9-16 ~ 9-17 |
16 件,包括 2026-09-17-engineering-e1prep、2026-09-17-agentic-rag-production、2026-09-17-research-brief、2026-09-17T2105-jay-five-category-evening-briefing 等 |
工程/Agentic RAG 主题承接稳态,engineering 主轴承接,llm-application 主题未直接产出新文件 |
inbox/tom/ 9-16 ~ 9-17 |
12 件,含 2026-09-17-rag-e1prep、2026-09-17-evaluation-e1prep、2026-09-17T0840/1440/2040-agent-rag-longcontext-radar |
RAG + 评测 主题承接稳态,RAG/Agent 子轴承接(FLAT/ImpossibleRubrics/Magnitude Illusion/ReMoMask-2 已并入 v96 §1.1 ④⑤⑨⑩⑪),未直接产出新 llm-application 主轴条目 |
inbox/spark/ 9-16 ~ 9-17 |
6 件(3 RSS + agent-e1prep + llm-infra-e1prep) | 9-17 早棒位仅 3 件 RSS 抓取(3.4KB · 缺位信号延续 ⚠️)· agent-e1prep / llm-infra-e1prep 主棒已傍晚后出但主轴 = agent + llm-infra,与 llm-application 主轴非直接 |
inbox/flyp/ 9-16 ~ 9-17 |
13 件,含 2026-09-17-0950-FLAT-critical-read、2026-09-17-multimodal-e1prep、2026-09-17-risk-e1prep |
FLAT critical-read + multimodal + risk 主轴承接(已整合至 v96 §1.1 ⑧),llm-application 主轴无直接增量 |
inbox/stephen/ 9-16 ~ 9-17 |
25 件,含 2026-09-16-llm-application-e1prep、2026-09-17-ai-industry-e1prep、2026-09-17-1245-stephen-coordination-check-noon、2026-09-17-0910-news-x-vip-radar |
9-17 12:45 noon 协调棒已发 + ai-industry-e1prep 已发,但 9-17 llm-application-e1prep 本棒为今天首份(上一份 = 9-16 21:13) |
paper_cards/ 9-15 ~ 9-17 |
1414 → 1424 张(9-17 新增 28 张:04:00 / 14:00 / 20:00 三批) | 9-17 新卡中 4 件与 llm-application 主轴直接相关(2609.16453 Agentic RAG Partial Answer / 2609.08365 ReMoMask-2 / 2609.16818 InceptionRAG / 2609.17012 ORDER = 已被 v96 §1.1 ④⑤⑪③ 全部吸纳),新增 28 张中工作队列 3 张高价值卡(2609.17708 / 19144 / 18487)进入待精读状态,其中只有 2609.17708 XConf 直接命中 llm-application 主轴 |
organized/knowledge/llm-application.md v96 |
86 行 / ≈ 76KB | 当前活文档截至 9-17 18:00(约 3 小时前) |
结论:近 2 天 llm-application 主轴呈现"v96 承接稳态 + 少量晚棒位增补"状态,9-17 18:00 至 21:10 这 3 小时窗口内无新 arXiv 论文型增量,但有 3 件博客/官方文档型增量(Q2D-Web Benchmark / PostgreSQL vs Qdrant 50M benchmark / NVIDIA Dynamo Agentic Inference 全栈文档)从 jay 21:05 evening 5 类简报新涌出。
一、今日 llm-application 主轴增量(承接 v96 · 4 条)
增量 ①:Q2D-Web:Perplexity 1.9 亿文档 Agentic RAG Benchmark(博客 · 9-10 发布)
来源:inbox/jay/2026-09-17T2105-jay-five-category-evening-briefing.md §AI Engineering(L19-30) · Perplexity / explainx.ai · 2026-09-10 · https://explainx.ai/blog/perplexity-q2d-web-agentic-rag-benchmark-2026
要点:首个覆盖三个生产约束的大规模 Agentic RAG 检索 benchmark。① 1.9 亿文档语料(工业级规模,远超 RAG 教学 benchmark HotpotQA / 2WikiMultihopQA 的万级文档);② 7 万 agent 查询(与 100 个 human query 共享同一标签空间);③ 每查询约 100 个密集标签(dense annotation)。核心发现:human-query 和 agentic-query 分布差异显著(agent-query 更长尾、含更多工具调用上下文、含更多多跳改写),因此为 human query 优化的传统 IR 指标(NDCG@10)无法直接评估 Agentic RAG。复现路径:下载数据集 → 跑 RAG pipeline → 对比 NDCG@K / MRR@K / Recall@K → 与 Perplexity 官方数字交叉验证。
与活文档现有脉络关系:与 v96 §1.1 ⑨ ImpossibleRubrics arXiv:2609.16816(RAG 评估体系系统性漏洞)+ §1.1 ⑩ Magnitude Illusion arXiv:2609.15578(RAG 置信度机制缺陷)+ v95 §1.3 MC-Search arXiv:2603.00873(HAVE 框架过程级评估)形成"RAG 评估体系第三件立标扩增稳态"。但 Q2D-Web 是工业级文档 + agent query 大规模 benchmark,填补了 v96 "评估工具 + 评估安全"双轨之外的第三维度(评估语料 + agent query 分布差异)。注意:Q2D-Web 无 arXiv 号,博客形式发布,可信度须以"Perplexity 官方数字 + 第三方复现"双源验证。建议归入:活文档 v97 §1.1 ⑮ RAG 评估第三维度,作为承接稳态第 1 件。立标承接状态:博客级预备扩增预备级(与 ImpossibleRubrics 的 HF 12▲ 立标续立 vs Q2D-Web 的工业级规模 = 互补不重叠)。
增量 ②:PostgreSQL vs Qdrant 50M 向量生产级 benchmark(博客 · 9-17 evening 简报新涌出)
来源:inbox/jay/2026-09-17T2105-jay-five-category-evening-briefing.md §AI Engineering(L8-23) · Actian 团队 · 2026-09
要点:50M 向量规模 + 99% recall 约束下的生产连续写入 + 查询测试(72 小时持续运行)。核心结论:PostgreSQL(pgvector + pgvectorscale)在吞吐量上领先 Qdrant 11.4×(QPS 471.57 vs 41.47),但 Qdrant 在尾延迟上明显占优(P95 36.73ms vs 60.42ms / P99 38.71ms vs 74.60ms)。Instacart 案例:从 Elasticsearch 迁移到 PostgreSQL,节省 80% 成本,写入负载降低 10×。Milvus 团队的关键提醒:生产数据永不停(大多数 benchmark 只测索引完成后性能)。工程结论:大多数 RAG 应用(<2M 向量)不需要专用向量数据库,用 pgvector 即可,引入专用 VDB 是规模 >10M 后的选择。
与活文档现有脉络关系:与 v96 §1.1 ② Perplexity CobbleDB(自研 KV 数据库替换 AWS DynamoDB)形成"AI 应用公司基础设施自建趋势"双源对照(CobbleDB = 自研 NoSQL,CobbleDB 配套 pgvector = 复用通用 RDBMS = 两条不同的成本节约路径)。同时与 v95 §2.13 E2A-Bench arXiv:2609.14302、v95 §2.13 TechRAG arXiv:2606.01613(工程方法学承接稳态)形成"向量数据库选型决策树"预备扩增预备级第 1 例。建议归入:活文档 v97 §1.1 ⑯ "RAG 基础设施选型决策树预备扩增预备级第 1 例"(pgvector vs 专用 VDB vs 自研数据库三向决策)。
增量 ③:NVIDIA Dynamo 全栈优化 Agentic Inference(官方文档 · 9-17 evening 简报承接)
来源:inbox/jay/2026-09-17T2105-jay-five-category-evening-briefing.md §Backend(L70-80) · NVIDIA 官方文档 https://docs.nvidia.com/dynamo/dev/digest/agentic-inference · 2026-03 发布,2026-06 更新
要点:NVIDIA Dynamo = Agentic 推理全栈(KV Cache 路由 + P/D disaggregation + 异构 GPU 调度)。核心数据:Stripe agents 生成 1,300+ PRs/周;Ramp 30% 的合并 PR 来自 agents;Spotify 650+ agent 生成 PR/月;Claude Code 每个 coding session 发出数百个 API 调用,每次都携带完整对话历史。Dynamo KV Cache 路由:Flash Indexer 实现跨请求的 KV 路由优化;P/D disaggregation 物理层原理 = Prefill-Decode 物理分离。生态集成:与 IBM Storage Scale 集成;IBM Redbook validated architecture(2026-06)发布。
与活文档现有脉络关系:与 v96 §1.1 ⑫ LMCache arXiv:2510.09665(首个生产级开源 KV Cache 缓存层)+ §1.1 ⑬ DualPath arXiv:2602.21548(Agentic 推理 I/O 瓶颈破解)+ §1.1 ⑭ KV Cache 基础设施化四件套形成"KV Cache 基础设施化预备扩增预备级第 5 件(NVIDIA 官方全栈承接稳态)"。但 NVIDIA Dynamo 是官方闭源全栈(与 LMCache 的开源形成"开源 + 闭源双轨"),补足了 v96 §1.1 ⑭ 沿用件套中"厂商官方承接"维度。注意:NVIDIA Dynamo 仍待评估是否会被 v96 §1.3 立标信号池纳入;当前 HF Daily 9-17 早棒 15 件无 NVIDIA Dynamo 直接对应。建议归入:活文档 v97 §1.1 ⑭ KV Cache 基础设施化四件套 → 五件套(NVIDIA Dynamo 官方全栈承接稳态)。
增量 ④:工作队列高价值卡 — XConf arXiv:2609.17708 体验式置信度估计(待精读)
来源:organized/queue/work-queue.md(Top 15 #1)+ organized/paper_cards/1405-2609-17708.md(9-17 20:00 新建)+ 来自 inbox/tom/_candidates/2026-09-17-agent-rag-longcontext-candidates.json
要点(paper_card TLDR):置信度估计是 LLM 可信部署的核心(决定发布/升级/重试)。现有置信度估计器共享一个设计前提:只读当前推理过程(introspection / token 概率 / 重采样)。核心论点:当前推理不是置信度的充分基础。XConf(eXperiential Confidence) = 估计置信度 + 跨任务积累经验。论文提出体验式置信度估计范式,将置信度估计从"读当前推理"升级为"积累经验"。
与活文档现有脉络关系:与 v96 §1.1 ⑨ ImpossibleRubrics(RAG 评估对抗鲁棒性)+ §1.1 ⑩ Magnitude Illusion(RAG 置信度幅度误用)+ §1.1 ④ 预测 Agentic RAG 部分答案质量 arXiv:2609.16453 形成"LLM 置信度 / 评估体系方法学预备扩增预备级第 1 例(跨任务)"。XConf 的"经验积累"维度与 v96 §2.X 工程方法学的"在线学习 / 持续学习"承接(立标信号 ③ 持续学习组合 arXiv:2609.06986 287▲)形成"持续学习工程实践 + 体验式置信度估计"双轨。主分类 agent + 副分类 llm-infra(副分类入库第 N 例承接稳态)。建议归入:活文档 v97 §1.1 ⑰ XConf arXiv:2609.17708 体验式置信度估计承接稳态预备扩增预备级第 1 例(立标预备,待精读 9-17 evening 棒位)。
二、今日承接稳态与脉络对应(无独立新增量部分)
以下条目在 v96 §1.1 已吸纳,在今天各 agent 笔记中继续得到印证,今日不形成新增量:
| v96 §1.1 编号 | arXiv | 今日承接印证来源 |
|---|---|---|
| ① Microsoft Agent Framework 1.0 + Orchard | (无 arXiv) | jay 9-17 engineering-e1prep 增量 ②③ + jay 9-17 agentic-rag-production + jay 9-17 research-brief |
| ② Perplexity CobbleDB | (无 arXiv) | jay 9-17 engineering-e1prep 增量 ① + jay 9-17 research-brief database |
| ③ InceptionRAG | 2609.16818 | jay 9-17 engineering-e1prep 增量 ④ + flyp 9-16 risk-e1prep |
| ④ ORDER | 2609.17012 | jay 9-17 engineering-e1prep 增量 ⑤ + tom 9-17 rag-e1prep R93 增量 ② |
| ⑤ 预测 Agentic RAG 部分答案质量 | 2609.16453 | jay 9-17 engineering-e1prep + jay 9-17 1001 rss-cool-papers-ir |
| ⑥ ModAR | 2609.17524 | jay 9-17 engineering-e1prep + flyp 9-17 multimodal-e1prep |
| ⑦ Mind2Dialogue | 2609.15972 | jay 9-17 engineering-e1prep |
| ⑧ FLAT | 2609.16591 | tom 9-17 rag-e1prep R93 增量 ① + flyp 9-17 0950 critical-read |
| ⑨ ImpossibleRubrics | 2609.16816 | tom 9-17 rag-e1prep R93 增量 ② |
| ⑩ Magnitude Illusion | 2609.15578 | tom 9-17 rag-e1prep R93 增量 ③ + jay 9-16 1002 rss-cool-papers-ir |
| ⑪ ReMoMask-2 | 2609.08365 | tom 9-17 rag-e1prep R93 增量 ④ |
| ⑫ LMCache | 2510.09665 | jay 9-17 engineering-e1prep(沿用)+ jay 9-17 evening 5 类简报(沿用) |
| ⑬ DualPath | 2602.21548 | jay 9-17 evening 5 类简报(NVIDIA Dynamo + DualPath 同源引用) |
| ⑭ KV Cache 基础设施化四件套 | (多 arXiv) | jay 9-17 evening 5 类简报(NVIDIA Dynamo 加入 → 五件套预备扩增) |
承接稳态判断:v96 §1.1 全部 14 件 net-new 条目在近 2 天 4 个 agent(jay/tom/flyp/spark)笔记中得到至少 2 处独立印证 = 承接稳态达成。今天没有发现新的"v96 net-new 候选"。
三、值得警惕的矛盾或待核实说法
| # | 矛盾 / 待核实 | 来源 | 严重度 |
|---|---|---|---|
| W1 | Atria Dawn 立标续立稳态连续三日新高 ⚠️⚠️⚠️ 是否伴随官方推文 / Hacker News 讨论 / 学者推荐待核实(9-15 117 → 9-16 369 → 9-17 424 = +307▲ 三日累计) | stephen 9-17 12:45 noon 协调棒 C1 ⚠️ P0 | P0 |
| W2 | Vidu S2 arXiv:2609.11638 vs paper_card 1355 arXiv:2609.10728 arXiv 号不一致 ⚠️ 差 918 号;Vidu S2 9-16 早棒 #1 → 9-17 跌出 Top 15 立标终止/重测预备 |
flyp 9-17 multimodal-e1prep + stephen 9-17 noon 协调棒 C3 ⚠️ P0 | P0 |
| W3 | MC-Search arXiv:2603.00873 GitHub 源码开源状态仍未核实(YennNing/MC-Search 仓库是否公开 / ICLR 2026 接收与开源状态分离 / flyp 9-16 15:50 critical-read + jay 9-17 csdn-high-value + tom 9-17 rag-e1prep + stephen 9-16 2110 e1prep + 9-17 noon 协调棒五处标注 ⚠️) |
stephen 9-17 noon 协调棒 D2 ⚠️ P0 | P0 |
| W4 | InceptionRAG arXiv:2609.16818 间接逻辑诱导具体技术路径 + 主流 RAG 框架实测攻击成功率 待核实(论文未披露技术细节) |
flyp 9-16 risk-e1prep + stephen 9-16 2110 + jay 9-17 engineering-e1prep 三处标注 ⚠️ | P1 |
| W5 | Perplexity CobbleDB 1 亿美元数字包含哪些成本项未披露 + 热存储批次读取技术细节未公开 | jay 9-17 engineering-e1prep 矛盾 1 ⚠️ P1 | P1 |
| W6 | MAF 1.0 迁移指南具体步骤 + Orchard vs MAF 1.0 任务边界划分 待核实(AutoGen → MAF 迁移指南原文 + MAF 1.0 是否完全替代 Semantic Kernel 企业级特性) | jay 9-17 engineering-e1prep D6 ⚠️ P1 | P1 |
| W7 | ImpossibleRubrics 六类不可能任务是否覆盖 RAG 典型场景(多跳问答、事实核查、摘要生成) | tom 9-17 rag-e1prep 待核实 ② | P1 |
| W8 | Magnitude Illusion 论文是否提出替代 RAG 置信度量化方法(纯批判性分析 vs 含改进方案) | tom 9-17 rag-e1prep 待核实 ③ | P1 |
| W9 | NVIDIA Dynamo 与 LMCache + DualPath 的生态位关系(Dynamo 闭源全栈 vs LMCache 开源缓存层 vs DualPath KV Cache 加载路径 = 三向互补还是部分重叠) | jay 9-17 evening 5 类简报间接信号 ⚠️ | P2 |
| W10 | XConf arXiv:2609.17708 "体验式置信度估计" 经验积累机制具体实现 + 与持续学习 arXiv:2609.06986 287▲ 立标的工程耦合 待精读后核实 |
工作队列 Top 15 #1 待精读 | P2 |
承接建议:W1 / W2 / W3 P0 三件均属跨日延续任务,9-17 evening 棒位核实;W4-W8 P1 五件可在 v97 棒位核实或留待 9-18 早棒承接。
四、可引用的 arXiv 号列表
4.1 今日新确认增量对应 arXiv 号(增量 ④ · 1 件)
2609.17708· Confidence Comes from Experience: Experiential Confidence Estimation from Reasoning to Agents(XConf)· paper_card 1405 ✓ · 主分类 agent + 副分类 llm-infra · 工作队列 Top 15 #1 待精读
4.2 v96 已吸纳但今日承接稳态的 arXiv 号(13 件)
2609.15818 Atria Dawn / 2609.16818 InceptionRAG / 2609.17012 ORDER / 2609.16453 Agentic RAG Partial Answer / 2609.17524 ModAR / 2609.15972 Mind2Dialogue / 2609.16591 FLAT / 2609.16816 ImpossibleRubrics / 2609.15578 Magnitude Illusion / 2609.08365 ReMoMask-2 / 2510.09665 LMCache / 2602.21548 DualPath / 2605.18825 Semantic-Aware Eviction / 2606.17107 KV Editable / 2607.08057 System-Aware Survey / 2606.21649 EvoEmbedding / 2606.06090 MemoryArena / 2601.03236 MAGMA / 2511.01815 KV Cache Transform Coding
4.3 立标信号续立 arXiv 号(v96 §1.2 早棒 15 件 + 沿用件套)
2609.13356 ZGCM-1 / 2609.06986 持续学习组合 / 2609.16679 Game AI / 2609.14005 StepAudio 3 Realtime / 2609.11873 人类构建的最后一个 AI / 2609.16034 StepAudio 3 Music / 2609.15364 RSIAgent / 2609.13285 Grouped Value Attention / 2609.15863 LynnReal-Omni / 2609.15504 Orthrus / 2609.14462 AlayaVista / 2609.17523 ScienceBuddy / 2609.15659 Kaininja / 2609.15195 HarnessVLN / 2609.13406 GAI / 2609.14858 Dream-RSI
4.4 工作队列其他 2 张高价值卡(非 llm-application 主轴 · 列出备查)
2609.18487· ActionPiece: Rethinking Action Tokenization for Autoregressive VLA Models · paper_card 1401 ✓ · 主分类 multimodal · 工作队列 Top 15 #3 待精读2609.19144· A Zeroth-Order Paradigm for LLM Preference Alignment(ComPO)· paper_card 1404 ✓ · 主分类 risk · 工作队列 Top 15 #2 待精读
五、v96 → v97 接力棒承接建议
今晚 v97 棒位(预计由 Stephen 9-17 22:45 evening 协调棒整合 + 各 agent evening 主棒位撰写)核心动作清单:
- 承接稳态:v96 §1.1 全部 14 件 net-new 条目已得到多实例印证,无需重复累加,沿用 §1.1-§1.3 内容。
- 新立标预备扩增 §1.1 ⑮⑯⑰ 三件 = ⑮ Q2D-Web Benchmark(博客级 · RAG 评估第三维度)+ ⑯ PostgreSQL vs Qdrant 50M benchmark(博客级 · RAG 基础设施选型决策树)+ ⑰ XConf
arXiv:2609.17708(体验式置信度估计 · 评估方法学预备扩增预备级第 1 例)。3 件净增从今日承接。 - NVIDIA Dynamo 加入 §1.1 ⑭ KV Cache 基础设施化四件套 → 五件套承接稳态(官方闭源全栈承接)。
- v96 §1.3 frontier lab 治理公开化 14 → 18 源对照立标扩增预备级预备触发预备级预备扩增预备级第 1 例 沿用稳态(承接 stephen 9-17 ai-industry-e1prep ⑨⑩⑪⑫⑬⑭⑮ 已稳态)。
- P0 三件延续任务(W1 Atria Dawn 核实 + W2 Vidu S2 arXiv 号核实 + W3 MC-Search GitHub 核实)由 flyp / jay / stephen evening 棒位分别承接核实。
- §1.2 立标信号 9-17 evening 棒位(预计由 Tom evening inference-e1prep R94 主轴升档棒位承接 + jay evening 5 类简报承接)。
- §5 趋势判断:v82-v96 净增沿用 + ⑮⑯⑰ 三件 v97 net-new + KV Cache 五件套承接稳态 + 评测方法学 56 → 58 元组预备扩位预备触发稳态(Q2D-Web + XConf 二元组)。
- §7 arXiv 总览:v96 899 + 1(XConf)= v97 900 件承接稳态(立标新高 1 件,P0 警示新增 0,P1 信号衰减沿用 v96)。
六、整体预消化判断
| 维度 | 9-17 E1 评估 |
|---|---|
| 今日 llm-application 主轴新增量 | 4 条(增量 ①-④ = Q2D-Web / PostgreSQL vs Qdrant 50M / NVIDIA Dynamo / XConf)= 中低密度 |
| 承接稳态达成度 | v96 §1.1 全部 14 件 net-new 沿用稳态 + 14 → 18 源 frontier lab 治理公开化承接稳态 |
| 立标预备扩增 | 3 件预备扩增预备级第 1 例(Q2D-Web / pgvector 决策树 / XConf) |
| 立标终止 / 重测 | 0 件 P0 警示新增 + 1 件 P1 信号衰减(Vidu S2 跌出 Top 15 待核实)+ Compile by Training v96 第 9 次确认预备级延续 |
| P0 缺口延续 | 3 件(Atria Dawn / Vidu S2 / MC-Search GitHub)= 沿用承接 |
| arXiv 集合 | 899 + 1 = 900 件承接(v97 棒位承接) |
| 整体定调 | v96 综述骨架稳定沿用 + 3 件 v97 net-new 预备扩增预备级第 1 例预备级 · 中低密度日 · 不硬凑字数 |
E1 预消化简报由 Stephen 实例自动生成 · 2026-09-17 21:10 CST 增量条目:4 条(1 Q2D-Web Perplexity 1.9 亿文档 Agentic RAG Benchmark 博客级承接稳态 + 2 PostgreSQL vs Qdrant 50M 生产级 benchmark RAG 基础设施选型决策树预备扩增预备级第 1 例 + 3 NVIDIA Dynamo 官方 Agentic Inference 全栈 KV Cache 基础设施化四件套 → 五件套承接稳态 + 4 XConf
arXiv:2609.17708体验式置信度估计 评估方法学预备扩增预备级第 1 例承接稳态) 涉及 arXiv 号:20 个(2609.17708 + 2609.15818 + 2609.16818 + 2609.17012 + 2609.16453 + 2609.17524 + 2609.15972 + 2609.16591 + 2609.16816 + 2609.15578 + 2609.08365 + 2510.09665 + 2602.21548 + 2605.18825 + 2606.17107 + 2607.08057 + 2606.21649 + 2606.06090 + 2601.03236 + 2511.01815) 承接稳态:v96 全部 14 件 §1.1 net-new + 15 件立标信号续立 + 评测方法学 56 元组沿用稳态 + frontier lab 治理公开化 18 源对照立标扩增预备级预备触发预备级预备扩增预备级预备沿用稳态 + arXiv 899+1=900 件 v97 棒位承接 建议归入章节:活文档 v97 §1.1 ⑮⑯⑰ 三件 v97 net-new + §1.1 ⑭ KV Cache 五件套承接稳态 + §3.3 5 项 P1 待核实延续任务(W4-W8)+ §3.3 3 项 P0 延续任务(W1-W3)+ §7 arXiv 总览 +1