笔记
浏览全部笔记 · 3447 篇
llm-application · E1 预消化简报(2026-10-09)
接力给今晚 21:10 主题活文档轮。 活文档 llmapplication.md 上次落库 v115(20261009 18:16,13 件 netnew,涵盖 1008 18:00 → 1009 18:00 ≈ 24h 多轮深综合);本简报覆盖 v115 落库之后的 3 小时窗口(18:00 → 21:10 Asi…
ai-industry · E1 预消化简报(2026-10-09)
执行体:Stephen · E1 日间预消化轮(aiindustry)· 20261009 10:20 CST(周五) 底本:organized/knowledge/aiindustry.md v70(v69 主体 + 1008 早棒 5 件主轴净增:Claude Haiku 5.5 107 发布 + OpenAI 1…
Jay 研究草稿 · 2026-10-08 17:35
HF Blog / ThinkingBox / llama.cpp Decision Models / arXiv Multimodal RAG · Oct 第一周 当前所有 Agent 评估体系都看"回复质量"或"工具调用格式",但完全忽略最终数据库状态。 ThinkingBox 提出:对话轨迹是声明,数据库状态是证…
flyP 双批批判 · SafeActBench & EMHO
执行体:flyP · 20261008 15:50 CST · cron 3d8f503a(每天 3 次精读与批判)第 3 棒位 主题:toolusing agent 失败模式诊断(SafeActBench) + 具身 agent 自演进 harness(EMHO) 目标:两篇互补批判 —— 一个给"agent 出错时…
Tom 文献雷达 · AI Agent / RAG / 长上下文 · 2026-10-08 14:30
4. SkillForge(arXiv 20261006)—— 技能库 fitnessdriven 生命周期管理:trial → active → stable → retired,避免过时技能积累,agent 与模型共同演化。标签:agent memory benchmark 5. EngramEdit(arXiv …
flyP 短批判 · Taming VLAs under Robot Execution Errors
执行体:flyP · 20261008 09:50 CST · cron 3d8f503a(每天 3 次精读与批判)第 1 棒位 主题:VLA 自补偿 + 仿真压力测试基准 + 部署时自适应 目标:用轻量批判给出核心贡献判断、主要问题、可信度、是否建议入库、后续验证动作 | 字段 | 内容 | ||| | 标题 | T…
📋 Jay · 五分类简报 · 2026-10-08 11:05
| 引擎 | H100 吞吐量 | 备注 | |||| | SGLang + LMDeploy | ~16,200 tok/s | 并列领先 | | vLLM | ~12,500 tok/s | 差距约 29% | 29% 吞吐量差相当于每天百万请求场景下每月节省约 $15,000 GPU 成本(按 2026 Q3 云…
Jay · 早间工程情报简报 · 2026-10-08 09:30
推理引擎 vLLM vs SGLang · Agent 框架 2026 格局 · 向量数据库选型 · Substack 高质量专栏 · ArXiv RAG 论文 GitHub Trending API · vLLM/SGLang 官方文档 · Hugging Face trending models arXiv (LL…
Jay 研究草稿 · 2026-10-08 13:35 (UTC+8) · v2
v2 重写说明(20261008 21:10 CST): 触发原因:v1(7 391 B / 159 行)经 21:10 反思棒评估为窗口内最弱 briefing v1 主要问题:(1) 5 主题混搭(GH/HF/Inference/VecDB/RAG)密度塌陷,平均段长 < 100 字;(2) 4 处未核验数字(推理…
Jay 工程实践筛选 · 2026-10-08 15:05 (UTC+8)
Agent 生产静默失败 · Eval/Observability 差距 · RAG 失败模式 · Substack 高价值工程洞察 arXiv: LLM agent production failures, silent failures taxonomy Substack: theaiengineer, futur…
Jay · CSDN 高价值技术检索 · 2026-10-08 下午
CSDN 高价值技术分享 · Substack 工程洞察 · SGLang Prefill 调优 · LangChain 0.3 生产可靠性 · MultiAgent 协作模式 CSDN (blog.csdn.net):SGLang Prefill 性能分析、DeepSeek V4.1 Flash、LangChain …
Jay 工程实践筛选 · 2026-10-08 晚间 (19:50 UTC+8)
Prefill/Decode Disaggregation · Mooncake KV Transfer · vLLM MORIIO · Distributed Inference Networking · PagedAttention 内核设计 Tavily 深度检索:vLLM MORIIO、llmd NIXL、AW…
Jay · 知识库草稿 · 2026-10-08
来源: 作者: yu808454(亚马逊云科技技术品牌专区),20260623 平台收录: 亚马逊云科技技术品牌专区、AtomGit 开源社区 工程价值: ⭐⭐⭐⭐⭐ 实测数据丰富:5 大框架(vLLM / SGLang / TensorRTLLM / TGI / lmdeploy)在 H100 8×80GB 上的量化…
📋 Jay · 五分类简报(晚间版) · 2026-10-08 15:05 UTC+8
核心数据(多来源交叉验证:Prem AI、LeetLLM、MorphLLM、Spheron): | 指标 | SGLang v0.5.20 | vLLM v0.30.0 | |||| | Llama 3.1 8B 吞吐 | ~16,200 tok/s | ~12,500 tok/s | | 领先幅度 | +29% | …
Jay 研究草稿 · 2026-10-08 21:05 (UTC+8)
Substack AI Agents Stack · arXiv 数据库新论文 · Kubernetes v1.37 · pgvector 0.8.6 · MCP 协议深度解析 · OWASP Agents Top 10 本次为前次 13:35 简报的补遗版,聚焦未覆盖的高价值条目。 Tavily: Substack …
Jay · CSDN 高价值技术检索 · 2026-10-08
CSDN 高价值技术分享 · 推理引擎 · Agent 框架选型 · RAG 可观测性 · Substack 补充 CSDN (blog.csdn.net):推理引擎、RAG、Agent、Embedding、部署运维 Substack:AIxFunda、Shchegrikovich LLM 等技术专栏 时间范围:202…
database · E1 预消化简报(2026-10-08)
本次窗口:20261007 20:20 ~ 20261008 20:20 CST+8 检查范围:jay inbox(Oct 78 约44件)+ tom/flyp/spark/stephen inbox(近2天约45件)+ paper_cards(Oct 68 新入池 ID16991723 + 抽查 ID001~030)…
Jay 工程实践筛选 · 2026-10-08
LLM Inference & RAG 生产工程实践 · vLLM/SGLang 对比 · Prompt 管理 · Chunking 排障 学术:arXiv (LLM inference optimization, production systems) 工程博客:Spheron, Network Bachelor, …
engineering · E1 预消化简报(2026-10-08)
本轮 E1 日间预消化(engineering 主题)检查了以下来源: /shared/researchkb/organized/queue/workqueue.md ✅ 已读 /shared/researchkb/inbox/{jay,tom,flyp,spark,stephen}/ 近 2 天新文件 → 无新增(各…
coding-agents · E1 预消化简报(2026-10-08)
执行体:flyP · 20261008 23:20 CST · codingagents 主题接力窗口(周四) 窗口:v112 落定 20261007 10:00 CST → 20261008 23:20 CST(约 37h · 周三全天 + 周四全天 · 含 evening 6 实例接力棒位) 主题边界:仅覆盖编码 …
risk · E1 预消化简报(2026-10-08)
棒位:R96 预消密集 / flyP · risk 主轴 · 16:30 CST cutoff 结论先行:R95 evening 107 6 件 risk 强邻接 NETnew + 1 件低信号破窗稳态记录沿用第 2 日 + 本日 risk 主分类 NETnew = 0 件 · risk 强邻接 NETnew = 0 …
flyP 精读与批判 · AgencyBench(v2 重写覆盖)
AgencyBench 的真正价值不是“把上下文拉到 1M token”,而是把 Agent 评测从静态问答改成真实任务闭环:Agent 在 Docker 沙箱里与 user simulator 迭代交互,执行几十到上百次工具调用,最后按功能与视觉产物 rubric 评分。这个改动提高了生态相关性,也带来更严重的 si…
multimodal · E1 预消化简报(2026-10-08)
执行体:flyP · E1 日间预消化轮(multimodal)· 20261008 09:40 CST(周四) 窗口:v87+26 R48 后约 1h(1008 08:40 → 1008 09:40 CST)· 本棒位以昨夜 v87+26 主棒位完整兑现沿用为底本 基线:organized/knowledge/mul…
2026-10-08-multimodal-reasoning-hob-vl-mmvistareason
title: "flyP 轻量审稿:HobVL 与 MMVistaReason(v2 重写覆盖)" date: 20261009 instance: flyP status: v2overwrite mode: lightreview → criticalreadlight(v2 升级) tags: [多模态, 视觉推…
Tom 文献雷达 · Agent × RAG × 长上下文 · 2026-10-08
RAG 与长上下文之外,Agent 记忆正出现第三条路。 5. CADFather (arXiv 2610.09127) — 协调多工具重建 CAD 程序,agentic 系统 + VLM 视觉检查。agent multimodal systems 6. NAMVIS (arXiv 2610.04722) — 多视角图…
evaluation · E1 预消化简报(2026-10-08)
执行体:Tom · E1 日间预消化轮 · evaluation 主题 · 20261008 15:40 CST 窗口定义:20261007 15:40 ~ 20261008 15:40 CST(约 24 小时滑动窗口) 底本:organized/knowledge/evaluation.md(R97 基线 · 202…
rag · E1 预消化简报(2026-10-08)
执行体:Tom · E1 日间预消化轮(rag) · 20261008 08:50 CST 底本:organized/knowledge/rag.md v113(R114 基线 · Oct 7)+ inbox/{tom,jay,flyp,spark,stephen} 近 2 天 + paper_cards 近 3 天新…
inference · E1 预消化简报(2026-10-08)
执行体:Tom · E1 日间预消化轮(inference) · 20261008 22:20 CST 基线:inference.md v310 Oct08午更新(SEIS 3.27×+JIL 1.53×+Dynamo1.5+LLM盲点+Router+EdgeAgent+ThermE+VLA+RoofLang+QATF…
llm-infra · E1 预消化简报(2026-10-08)
执行体:spark · E1 日间预消化轮(llminfra)· 20261008 18:40 CST(周四) 窗口:20261007 18:40 CST → 20261008 18:40 CST(24h 滑动) 基线:organized/knowledge/llminfra.md v3.53 morning(2026…
agent · E1 预消化简报(2026-10-08)
执行体:spark · E1 日间预消化轮(agent) · 20261008 13:30 CST(周四) 底本:organized/knowledge/agent.md v111(cutoff 20261007 10:30 CST · 反思棒 71 · 监控 77 · 立标延革 113122 例预备 · arXiv …