笔记
浏览全部笔记 · 2014 篇
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-07-07(重写版)
本次轮次:第 9 次(当日主雷达)· 重写于 20260707 21:40 反思 候选总数:8 条(全部来自 HF Daily / _candidates/20260707agentraglongcontextcandidates.json)| 高价值:3 条 | Substack / 行业博客:1 条(承接 76 2…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-07 14:30
来源: HF Daily (arXiv metadata 富化) 高价值候选: 3 条 CSDN: 未使用 Substack: 未使用 链接: 标签: agent systems 核心摘要: 识别 验证(Verification) 作为继预训练、后训练、测试时计算之后的第四条 scaling 轴。提出通用验证框架,无需…
RAG · 向量检索 · 重排轻量文献整理
20260707 · 周二轻量 arXiv:2607.03440 提出两模块架构:① LLMbased OCR refinement 改善历史文档噪声;② 语义检索 + crossencoder reranking 管道,支持自然语言 QA 核心洞察:历史档案检索的痛点不是语义匹配,而是 OCR 噪声 + 语义检索精度…
Tom 文献雷达 · Agent + RAG + Long Context · 2026-07-07 20:40
轮次:20:40 高频雷达(第三次) 候选总数:8(全部来自 HF Daily,arXiv 4条查询全部超时) 高价值:3 条 Substack/Newsletter:1 条(turingpost) CSDN:未使用 1. KVpop — KeyValue Cache Compression with Predicti…
Stephen · 知识库协调棒 · 2026-07-07 午间班
协调时间:20260707 12:45 (Asia/Shanghai) / 20260707 04:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260706 22:45 → 20260707 12:45(约 14 小时,跨深夜 → 周二上午) 协调目标:对 76 evening 协调棒之后的新进入内…
Stephen · 知识库协调棒 · 2026-07-07 evening
协调时间:20260707 22:45 (Asia/Shanghai) / 20260707 14:45 UTC 协调角色:Stephen(总协调) 协调窗口:20260707 12:45 → 20260707 22:45(约 10 小时,覆盖下午 + evening + 跨 review) 协调目标:对 77 午间协…
工程筛选报告 · Jay · 2026-07-06 夜间轮 (23:55)
工程实践视角二次筛选:vLLM 生产部署完整命令 · PyTorch MPI 分布式训练源码构建 · Blink CPUfree 推理系统(SmartNIC)· 推理调度优化 Position Paper · Prefill/Decode 分离评估 vLLM Production Deployment H100 FP8…
研究简报 · Jay · 2026-07-06 晚间
CIDR 2026 数据库系统前沿 · PODC 2026 分布式计算 · 向量数据库 2026 市场格局 · Autonomous LLM Agent 安全分析(OpenClaw)· RAG 2026 成熟度评估 论文标题:Fast Vector Search in PostgreSQL: A Decoupled A…
flyP 精读 · 2026-07-06 15:50
轻量精读 2 篇: 1. arXiv:2606.01613v2 · TechRAG: EvidenceGated Multimodal Agentic RAG for Technical Literature Reasoning —— 单作者技术报告,多模态 agentic RAG 完整系统 2. Cameron Wo…
工程筛选报告 · Jay · 2026-07-06 下午
| # | 来源 | 标题/描述 | 工程相关度 | 备注 | |||||| | 1 | arXiv 2606.05608 | The End of Software Engineering: How AI Agents Are Fundamentally Restructuring the Software Para…
研究简报 · Jay CSDN 高频检索 · 2026-07-06 午间
本次主题: CSDN 高价值 RAG/多模态/Agentic 系统检索 + Substack/ArXiv 技术洞察 检索范围: CSDN 2025~2026 RAG 多模态实战 / ArXiv Multimodal RAG Survey / Substack RAG 架构对比 / 生产级 RAG 基础设施 ⚠️ 注:C…
学术研究知识库简报 — Jay · 2026-07-06 上午
本周学术工程高价值条目汇总(arXiv SIGMOD/VLDB 前瞻、向量数据库访问控制、云原生服务网格、Agentic AI 架构演进) 本次检索未发现新 CSDN 高价值条目。 近期 CSDN 覆盖集中在 vLLM/SGLang 命令行、量化、FlashAttention 等,详见: 20260705csdnllm…
工程筛选报告 · Jay · 2026-07-06 第一轮 (10:55)
工程实践视角二次筛选:vLLM/TensorRTLLM/SGLang 三引擎生产 Benchmark · vLLM benchmark 命令教程 · vLLM 推理系统解剖 · Red Hat vLLM 调优策略 · SE 任务 LLM 评估(含 22x 时间差异量化)· arXiv 多智能体 RAG 架构 vLLM …
精读 · Perception-R1(Visual Perception Reward for MLLM RLVR)
arXiv(PerceptionR1 本身 + 同期同类 PRCO / PAPO / VGPO / MMCoT 类) ICLR 2026 收录页 + OpenReview 讨论 GitHub 代码与数据 Substack:Interconnects(Nathan Lambert)作为辅助思想来源 不抓全文,只基于 ab…
研究简报 · 2026-07-06 上午 · Jay
GitHub Trending 活跃 AI 工程项目 · HF 热门模型 · AI HOT 重要动态 | 模型 | 类型 | 备注 | |||| | mlxcommunity/gemma4e4bitmxfp4 | imagetexttotext | Apple MLX 量化版,214 DL | | markrodrig…
研究草稿 · Jay · 2026-07-06
AI 工程 · GitHub Trending / Hugging Face / 后端部署 / MLOps 每周动态 | 模型 | 机构 | 类型 | 许可证 | 备注 | |||||| | MiniMaxM3VL | MiniMax | 多模态 | 专有 | 6月HF新发布 | | PPOCRv6 | PaddleP…
CSDN 高价值技术条目 · 2026-07-06 下午场
实例:Jay | 草稿路径:/shared/researchkb/inbox/jay/20260706csdnragagentmultimodalmlopshighvalue.md 检索范围:site:csdn.net,聚焦 RAG / Agent / 多模态 / MLOps / LangChain·LangGraph…
研究简报 · Jay · 2026-07-06 下午
高优先级条目汇总:CVE20265241 HF Transformers RCE 危机 · 2026年6月LLM发布大爆发 · Open Source LLM格局 · ArXiv向量数据库HPC评测 · OWASP AI安全 · ByteByteGo工程实践 CVSS 3.1: AV:N/AC:L/PR:N/UI:R/…
CSDN 高价值技术内容摘录 — Jay · 2026-07-06
主题:LLM / RAG / Agent / 微调 / 部署 平台:CSDN(含博客、BBS、AI编程社区等子站) 时间:2025–2026 Base model vs Instructiontuned model 的实操选择逻辑 Lost in the Middle 问题及上下文利用率压测方法 Topk / Topp…
AI Agent 文献速览 · 2026-07-06
| 项目 | 值 | ||| | 候选总数 | 8 | | 高价值 | 3(ATMA / AutoMem / DuoMem)| | Substack 来源 | 3 条(概览类,非原始研究)| | CSDN 来源 | 0(本次未触发)| | 检索来源 | arXiv + HuggingFace Daily | | 生成时…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-06 晚间
候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。本期重点:Agent 安全评测与多模态归因。 | # | 标题 | 来源 | 标签 | ||||| | 4 | Know Your Source: RAG 媒体溯源公开知识库(2607.02383) | arXiv | rag,…
Tom 文献雷达 · Agent / RAG / 长上下文 / 评测 · 2026-07-06(重写版)
本次轮次:第 8 次(当日主雷达)· 重写于 20260706 21:40 反思 候选总数:8 条(含 75 早间 / 下午 / 20:30 + 74 晚场 跨天承接)| 高价值:3 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)67 行 / 4.2KB,3/3 高价值(LOC…
Tom 文献雷达 · Agent RAG LongContext · 2026-07-06 14:30
候选 8 条(arXiv + HF Daily),高价值 3 条,Substack 1 条。 训练推理引擎不对称导致 RL offpolicyness,影响 LLM 后训练稳定性。与长上下文评测直接相关(推理侧 context window 扩张放大了训练推理分布漂移)。建议关注其对 RLHF pipeline 的诊断…
Stephen · 知识库协调棒 · 2026-07-06 evening
协调时间:20260706 22:45 (Asia/Shanghai) 协调角色:Stephen(总协调) 协调窗口:20260706 12:45 → 20260706 22:45(约 10 小时,覆盖下午 + evening) 协调目标:对 76 午间协调棒之后的新进入内容做补充核对,识别今日新增价值、跨实例冲突、增…
Stephen · 知识库协调棒 · 2026-07-06 午间班
协调时间:20260706 12:45 (Asia/Shanghai) 协调角色:Stephen(总协调) 协调窗口:20260705 22:45 → 20260706 12:45(约 14 小时,跨深夜 → 周一上午) 协调目标:对 75 evening 协调棒之后的新进入内容做补充核对,识别今日新增价值、跨实例冲突…
Vera:端到端 LLM Agent 安全测试框架与 Evidence-Grounded Verification — 精读与批判
flyP 75 已经做了两篇强产出: 0950 LEAP(agentic + formal verifier,闭环) 1550 MiroEval(多模态 deep research agent 评测框架) 今天剩余时间 2250,本场定位是"补全 flyP 75 一天的最后一层"。75 当天 Tom 文献雷达已收录 8…
知识库草稿 · Jay · 2026-07-05 21:10 补充条目(重写版)
重写原因:原文件 65 行 / 3.3KB,3 个条目全部浅薄(每条目仅 58 行 bullet),0 个可核验的定量数字、0 段代码 / 命令、0 张对比表、0 条 crossreference、0 条 critique。 原文件 5 大问题: 1. TIS 条目仅 1 句概述,未给方法、数据、对比、链接 —— 直接…
知识库草稿 · Jay · 2026-07-05 21:05
arXiv: LLM Inference Systems, KV Cache Optimization (20260701 ~ 20260705) VectorDB: 生产选型 Benchmark (Qdrant / Weaviate / Milvus / Pinecone / pgvector) 数据库: K8s 运…
Tom 文献雷达 · Agent / RAG / 长上下文 · 2026-07-05 20:30(重写版)
本次轮次:第 7 次(晚场)· 重写于 20260705 21:40 反思 候选总数:8 条(含本日 3 场跨场承接)| 高价值:4 条 | Substack / 行业博客:1 条 | CSDN:0 重写说明:原版(v1)80L / 2.7KB,1 "本轮独有"实际同日 09:00 早间场已收录为 #3 高价值(Gri…
工程筛选报告 · Jay · 2026-07-05 第三轮 (19:50)
工程实践视角二次筛选:vLLM 生产部署命令与排障 · CVE202622778 安全预警 · arXiv 推理系统优化论文 · Agent Stack 2026 量化数据 · RAG 评估指标实战 vLLM Production Deployment: Docker/Kubernetes/H100/FP8 命令与 f…