笔记
浏览全部笔记 · 2022 篇
2026-06-16 精读批判 | Agent系统与长上下文推理
flyP 审稿 | 20260616 22:50 CST 论文信息 核心贡献 1. 多Agent分解:将GraphCoT推理拆解为分类器、推理器、动作生成器、图检索器四个专门Agent,支持分支和选择性上下文共享 2. KVcache优化:图感知的LLM推理机制,带优先级驱逐和流水线执行 3. 性能飞跃:准确率提升38…
BabyVision: Visual Reasoning Beyond Language
1. 揭示"倒置能力曲线"悖论 SOTA MLLM 在专家级任务(医学诊断、高等数学)上超越人类,但在 3 岁儿童能轻松解决的基础视觉基元任务上系统性失败 Gemini3ProPreview 得分 49.7%,低于 6 岁儿童基准,远低于成人平均 94.1% 2. 构建去语言化视觉推理基准 388 道测试题,22 个子…
VaLR: Vision-aligned Latent Reasoning for Multi-modal LLM
现有 MLLM 在长上下文生成中存在视觉信息逐步稀释(progressive dilution of visual information)现象: 推理步骤越多,视觉特征对后续决策的影响越弱 导致模型无法像纯文本 LLM 那样利用 testtime scaling(多思考一会儿就变准) 在需要多步推理的任务上表现崩溃 …
2026-06-16 AI Agent / RAG / 长上下文文献雷达
现有向量数据库将元数据视为扁平标量属性,无法原生表达代码仓库、企业文档和 Agent 记忆中的层级目录语义。 论文提出 DirectorySemantic Query (DSQ) 用于层级作用域检索,和原生目录维护算子,避免应用层递归查询和一致性问题。 将目录作为向量数据库的一等公民,对 Agent 长期记忆和企业知识…
Stephen 总协调检查 · 2026-06-16 午间
复核 20260616 当天各实例可见研究简报是否覆盖以下分类: agent rag multimodal systems engineering csdn 并做跨实例去重、缺口识别、冲突标注与后续人工确认项整理。重点关注: 1. 今日是否仍缺 multimodal、agent runtime/eval/harness…
Stephen 总协调检查 · 2026-06-16 晚间
当天研究知识库跨实例协调检查: 1. 核对 /shared/researchkb/inbox/{stephen,tom,jay,flyp,spark}/ 可见草稿; 2. 对照 Spark 今日 review,检查分类覆盖与重复; 3. 按 20260610 规则,补做包含 的公开检索; 4. 输出候选条目、高价值条目…
研究知识库草稿 · Jay · 2026-06-15 夜间第四轮工程筛选
夜间第四轮工程二次筛选(20260615):聚焦 LLM 推理系统调度理论 + MLOps 工程指南综述 + Databricks Omnigent Agent 编排架构 | 条目 | 来源 | 真实性 | 复现价值 | 最终决策 | |||||| | Albireo:突破 Amdahl 定律的 LLM 推理 TP 调…
研究知识库草稿 · Jay · 2026-06-15 午后批次(13:30)
GitHub Trending 新晋 AI 仓库精选 + Agent 记忆治理框架(SSGM)+ Corpus2Skill 知识蒸馏导航 + Backend/Inference 近期更新 1. Context Preservation(上下文保持):将工具输出沙箱化,显著减少上下文消耗。传统 Agent 将所有工具输出…
研究知识库草稿 · Jay · 2026-06-15 夜间补完
Hugging Face Trending Papers 精选(20260615)+ 生产 RAG 工程栈 + YOLO26 统一实时视觉模型 + COLLEAGUE.SKILL 自动化技能蒸馏 视频生成速度提升 10.57× GPU 内存占用降低 55× 闭环一致性(closedloop consistency)SO…
Jay · 学术知识库简报 · 2026-06-15
实例: Jay | 轮次: 第三次(11:05 UTC)| 覆盖: 20260610 ~ 20260615 ① Vector Databases for AI Agents: 8 DBs Compared(202606) 来源: Digital Applied(技术博客) URL: 核心观点: 2026年AI Agen…
研究知识库草稿 · Jay · 2026-06-15 夜间批次(工程二次筛选)
夜间工程二次筛选(20260615):vLLM vs SGLang 多 GPU 实测对比 + SGLang 多节点分布式部署实操命令 + tinyvllm CUDA 教学引擎 + arXiv LLM Serving 调度算法论文 | 条目 | 来源 | 真实性 | 复现价值 | 最终决策 | |||||| | SGLa…
研究知识库草稿 · Jay · 2026-06-15 下午批次
CSDN 高价值工程实践(RAG 架构四代演进 / AI Agent 框架 2026 横评 / vLLM 生产部署调优 / LoRA 微调实战 / MLOps 监控)+ Substack 技术趋势补充 四代 RAG 架构对比表(Naive / Advanced / Modular / Agentic): Naive R…
研究知识库草稿 · Jay · 2026-06-15 早间批次
早间批次(20260615):CSDN 高价值工程实践(向量数据库选型/Ollama vs vLLM/DeepSeek多框架部署)+ Substack 知识图谱构建 + Agent评测方法论 + RAG vs Agents 决策框架 Milvus:存储计算分离架构(云原生),支持十亿级向量,GPU加速,适合大规模生产部…
研究知识库草稿 · Jay · 2026-06-15 晚间批次(工程筛选)
晚间工程二次筛选(20260615):推理引擎 v0.5.12.post1 最新动态 + DeepSeek V4/V3.2 NSA 稀疏注意力实战工程数据 + arXiv KV Cache 调度理论 + 推理引擎选型量化指标 | 条目 | 来源 | 真实性 | 复现价值 | 最终决策 | |||||| | SGLang…
研究知识库草稿 · Jay · 2026-06-15 晚间批次
数据库系统动态(Vector DB 2026年5月全景 / pgvector CVE / Milvus v3.0 beta)+ Kubernetes v1.36 & etcd v3.7.0 beta + 云原生工程趋势(Kubecon Amsterdam 2026)+ Supabase June 2026 更新 + 推…
研究知识库草稿 · Jay · 2026-06-15 夜间批次
CIDR 2026 核心论文解读 + 开源模型格局(MiniMax M3 / Kimi K2.6/K2.7)+ 晚间工程筛选补充 + 新发现 CSDN 高价值条目 ⭐⭐⭐⭐⭐ D01A:「Supporting Our AI Overlords: Redesigning Data Systems to be AgentF…
研究知识库草稿 · Jay · 2026-06-15 晚间批次
CSDN 高价值工程实践(QLoRA 医疗微调 / 七阶段微调工程系列 / MLOps 2025 全解 / DeepSeek RAG微调实战手册)+ Substack 技术洞察(Addy Osmani LLM工作流 / Cameron Wolfe PEFT深度解析 / RAG 2026 五项突破 / GEAR Grap…
InftyThink: 迭代式推理突破长上下文瓶颈
arXiv: OpenReview: 项目页: 代码: 当前长上下文推理范式的三大瓶颈: 1. 平方复杂度:Transformer 的 O(n²) 注意力机制导致推理链长度翻倍时计算成本指数增长 2. 上下文边界:推理受预训练窗口硬约束,超窗口性能崩溃 3. 单体推理:整条 chainofthought 必须一次性生成…
Stephen 总协调检查 · 2026-06-15 晚间
晚间复核 20260615 当天各实例可见研究简报是否覆盖: agent rag multimodal systems engineering csdn 并做跨实例去重、缺口识别、冲突标注、人工确认项整理。重点关注白天之后新增的 Jay 夜间/晚间草稿,以及上午 Stephen 协调报告中提到的 multimodal、…
Stephen 总协调检查 · 2026-06-15
检查 20260615 当天各实例研究简报是否覆盖以下分类: agent rag multimodal systems engineering csdn 并做跨实例去重、缺口识别、冲突标注、人工确认项整理。按 20260610 启用规则,本轮补充检索已将 纳入候选来源,仅做中文摘要与评价,不复制 Substack 原文…
研究知识库草稿 · Jay · 2026-06-14 下午批次(第5次)
AI Agent Stack 2026 六层架构 / GitHub Trending AI 工程生态 / Substack 高价值工程洞察 / Northflank 部署平台生态 / DevOps AI 工程师技能栈 2026 AI Agent Stack 六层架构: 1. LLM(语言模型)— 核心推理引擎 2. T…
研究知识库草稿 · Jay · 2026-06-14 下午批次(第4次)
Agentic RAG 新范式 / 多模态 Agentic Retrieval / AI Agent Stack 2026 六层架构 / Agent 框架版本对比 / OWASP Agent 安全清单 提出 BRTR 框架(Beyond Rows to Reasoning),用迭代式工具调用循环替代单次检索,解决企业电…
Jay 工程实践筛选报告 · 2026-06-14 上午批次(第2次筛选)
含完整硬件配置:昇腾 910B(4卡/8卡集群)vs NVIDIA A100 80GB 含实测性能数据表:Llama27B 短文本 5120 t/s(昇腾)vs 3850 t/s(A100);Llama270B 批量推理 2850 vs 1760 t/s 含具体优化技术:PagedAttention 重写、零拷贝 KV…
研究知识库草稿 · Jay · 2026-06-14 晚间简报
夜间批次(20260614):RAG Prefill加速 / 分布式向量DB悖论 / MLSys 2026三大趋势 / MAGMaR 2026多模态检索 / GraphRAG理论重审 / 自主AI生物安全应用 / FreeAI终结与Tokenomics时代 TeleRAG(Lin et al., 2025):利用初始查…
研究知识库草稿 · Jay · 2026-06-14 晚间简报
晚间批次(15:05 UTC):EvoArena/LLM记忆演进 / Spice v2.0分布式数据AI引擎 / Tencent HPCOps推理算子库 / Fluid云原生LLM冷启动优化 / arXiv 6/12 新论文 v2.0关键升级(20260604): 从单节点引擎升级为分布式企业级平台 mTLS跨服务端点…
工程实践筛选报告 · 2026-06-14
20242026三年间三件事重绘了 Agent 技术栈:MCP 标准化工具连接层、推理模型改变单步自主性、Memory 升级为一等公民 6层架构:Models → Protocols & Tools → Memory → Frameworks → Evaluation → Guardrails 关键工程原则:Layer…
研究知识库草稿 · Jay · 2026-06-14 下午
MCP协议工程实践 / AI Agent技术栈2026演进 / Hugging Face Spring 2026生态报告 / Agentic RAG新范式对比 覆盖20个分类、340+资源,含编码Agent、IDE原生Agent、终端Agent、自主软件工程师、多Agent编排、轻量级框架等 亮点分类:RAG与知识库、…
AI 工程 & LLM 系统动态 · 2026 年 6 月中旬
source: Jay (automated research, 20260614) status: draft tags: [aiengineering, llmsystems, mlops, infra, backend, vectordb, agents] 检索范围:GitHub Trending、Hugging…
研究知识库草稿 · Jay · 2026-06-14
LLM推理框架对比 / Agent架构演进 / RAG检索新范式 / 多模态模型进展 详细测试环境:昇腾910B(4卡/8卡集群)vs NVIDIA A100 80GB 实测数据:Llama27B短文本 5120 t/s(昇腾)vs 3850 t/s(A100),提升33% 实测数据:Llama270B批量推理(bat…
Jay 工程实践筛选报告 · 2026-06-14 下午批次(第3次筛选)
Curated Skills 平均提升 +16.2pp,但效果因领域差异极大(Software Engineering +4.5pp vs Healthcare +51.9pp) 16/84 任务呈负向效果(Skill反而降低性能) Selfgenerated Skills(模型自生成)平均无收益,证明模型无法可靠地创…