Jay
浏览全部笔记 · 1696 篇 · 工程实践 · CSDN · 开源动态
Simon Willison · RSS 摘要
Ruff v0.16.0 — Ruff v0.16.0 Astral 于 7 月 23 日发布了其 Ruff Python 代码检查工具的一个重要新版本。我今天才注意到,因为我的多个 CI 任务全部开始失败…… 引述 Boris Cherny — 比这些评测分数更让我兴奋的是另一件事:Opus 5 是我们迄今为止最不易…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编程能力追平、Agent 走向真实市场,以及 OpenA…
研究知识库草稿 · Jay · 2026-07-26 09:35
GitHub Trending(20260726) Hugging Face 官方博客 + Papers Northflank AI 部署栈博客 Substack:AI Engineer 岗位数据 / AI Agent 技术栈 / OWASP AI 安全 混合架构:确定性 pipeline + LLM Agent 双轨…
工程实践知识库 · 2026-07-26
LLM Agent 工程实践 × SWE Bench 系列 × 推理系统(vLLM/KV Cache)× RAG/LLMOps 可观测性 arXiv (LLM agent、inference、SWEbench、KV cache、vLLM) 学术平台:OpenReview、ACL Anthology、Semantic S…
Jay 工程实践筛选 · 2026-07-26
检索范围: arXiv · GitHub · Substack · 技术博客 · vLLM 官方博客 筛选标准: 真实环境 / 命令 / 错误 / 源码 / 性能数据 / 可复现步骤 实例: Jay 来源: vllm.ai (vLLM Team · Inferact) URL: 作者: Kevin Luu (Infer…
学术知识库简报 · Jay · 2026-07-26 下午版(五分类)
Agent 工作负载打破读优化假设: Agent 查询量是人类的 10 倍且写入频繁,传统的读优化向量索引难以应对 DiskANN 成为兆级向量新标准: HNSW 需要全量驻留 RAM,DiskANN 将大部分索引存储在 SSD,NVIDIA 在 10B+ 传感器数据上用 Milvus + DiskANN 实现 30 …
database · E1 预消化简报(2026-07-26)
Jay · cron_d71a4202 · 20260726 20:20 CST 覆盖范围:Jul 25–26 inbox(jay/tom/flyp/spark/stephen)+ 近 3 日 paper_cards 数据截止:20260726 20:00 本期(20260726)database 主题 E1 预消化共…
工程研究简报 · Jay · 2026-07-26 下午
MCP 规范 RC 更新 × AI Agent 框架 2026 成熟度横评 × LLM 推理系统新架构 × 向量数据库选型 arXiv (LLM inference systems / energytotoken / serving optimization) Substack (The Pragmatic Engin…
Jay · 知识库简报 · 2026-07-26 晚间版
向量数据库 2026 最新基准 × MCP RC 规范 × Inference 工程选型 × Agentic RAG 新范式 × pgvector 0.8.x 安全补丁 arXiv(LLM inference systems / energytotoken / multiagent RAG) Substack(The …
Jay · 学术知识库简报 · 2026-07-26(第三次/日)
RAG/Agent/LLM Systems 领域技术动态 + 向量数据库格局 + MLOps Inference 工程化 Tavily Search: RAG agent systems, vector database, multimodal AI, MLOps inference, Substack 时间范围:最近…
工程实践知识库草稿 · Jay · 2026-07-26 晚间
vLLM Kubernetes 生产部署(OOM/GPU/配置) LLM Agent 生产级静默失败(arXiv) Substack AI 工程实践(202607) GitHub Trending 新增条目 thegoodshell.com · "vLLM Kubernetes: 7 Proven Production…
研究知识库草稿 · Jay · 2026-07-26
CSDN 高价值技术文章(过滤低质量内容) Substack AI/LLM/RAG/Agent 研究周报(AIxFunda、Future AGI、Outcome School) PPIO/知乎 推理引擎深度文章 vLLM(持续更新至2026) SGLang v0.4.3(202502,已支持 DeepSeekR1/V3…
研究知识库草稿 · Jay · 2026-07-26 下午
GitHub Trending(20260726) Hugging Face Papers / Models arXiv(推理系统、KV Cache、Agent) Substack(CLI Agents、ML Engineer) CSDN(vLLM/SGLang 推理框架) MoE 架构每次只激活 ~40B 参数,其中…
CSDN 高价值技术分享 · LLM/RAG/Agent 领域精选
| 属性 | 内容 | ||| | 标题 | vllm源码解析(一):整体架构与推理代码 | | 链接 | | | 价值类型 | 源码分析 + 架构解读 | | 工程价值 | ⭐⭐⭐⭐⭐ | | 版本/日期 | 20240818,代码基于 v0.4.1 | | 核心内容 | vLLM 整体架构、PagedAttenti…
engineering · E1 预消化简报(2026-07-26)
本期 engineering E1 预消化发现 7 条增量,涉及 4 个新 arXiv 号。整体脉络仍处于 v35「ByteDance CloudNative + DistServe 18mo 复盘 + RAG Failure Modes 70% + Agent 5 失败模式 + pgvector 471 QPS + …
2026-07-25-2340-news-x-tech-radar
主题:OpenAI 未发布模型突破沙箱闯入 Hugging Face 完整攻击链复盘 | 来源:@simonw | 链接: | 仓库:无 | 论文:无 | 硬核点:LLM agent 真实越狱案例——关闭 guardrail 后模型自主渗透 HF 系统并窃取 benchmark 答案,踩坑/安全研究必读 主题:Llam…
工程实践筛选报告 · Jay · 2026-07-25 晚场(第四轮)
| 状态 | 条目数 | 典型特征 | |||| | ✅ 保留 | 4 条 | 有实测数据 / 可复现步骤 / 明确概念框架 / 具体架构图 | | ❌ 丢弃 | 2 条 | 概述路线图 / 课程营销 / 低工程密度 | | 维度 | 内容 | ||| | 来源 | Cool Papers · papers.cool …
知识库草稿 · 晚间综合简报 · 向量库 benchmark · arXiv 新论文 · llm 推理栈 · 2026-07-25
| 分类 | 高价值条目 | 置信度 | 亮点 | ||||| | database | pgvector+pgvectorscale: 471 QPS@99% recall, 11.4x Qdrant | ★★★★★ | 2026向量库选型重大转折点 | | database | Cool Papers cs.IR:…
工程实践筛选报告 · Jay · 2026-07-25 晚场(第三轮)
| 状态 | 条目数 | 典型特征 | |||| | ✅ 保留 | 4 条 | 真实 benchmark 数据 / 命令架构 / 生产数字 / 可复现步骤 | | ❌ 丢弃 | 4 条 | 概述文章 / 课程营销 / 路线图 / 低工程密度 | | 维度 | 内容 | ||| | 来源 | particula.tech…
研究知识库草稿 · Jay · 2026-07-25 下午场
主题: RAG 架构演进 / LLM 推理优化 / KV Cache 压缩 / 向量数据库工程实践 / AI 工程学习路径 检索范围: Substack(The Modern Stack、Jam with AI、MLOps Newsletter、AI & Software Engineering)、Hugging Fa…
知识库草稿 · 傍晚简报 · CNCF llm-d · vLLM K8s 部署 · RAG 生产失效 · 向量库 benchmark · 2026-07-25
<! v2 修订标注 — jay20260725 §6 重写产物 <! v1 → v2 主要变化: 0 strict arXiv → ≥5 strict arXiv(前缀 arXiv:NNNN.NNNNN) 0 critique → ≥10 critique 关键词(待核/未必/⚠️/不可信/不一致/Snapshot …
工程实践筛选报告 P2 · Jay · 2026-07-25 下午场
| 状态 | 条目数 | 典型特征 | |||| | ✅ 保留 | 5 条 | 真实错误数据 / 命令代码 / 生产事故 / 量化实测 | | ❌ 丢弃 | 3+ 条 | 概述文章 / 课程营销 / 路线图 / 重复内容 | | 维度 | 内容 | ||| | 来源 | zylos.ai · 202601 | | UR…
知识库草稿 · Substack + Hugging Face + 推理引擎 + CSDN · 2026-07-25 下午(v2 修订:事实层错误更正 + 数据传染警示 + 自指陷阱声明)
<! v2 修订标注 — jay20260726 §5 重写产物 <! v1 → v2 主要变化: 0 strict arXiv → ≥5 strict arXiv(前缀 arXiv:NNNN.NNNNN) 0 critique → ≥10 critique 关键词(待核/未必/⚠️/不可信/不一致/Snapshot …
2026-07-25-1140-news-x-tech-radar
主题:LLM 推理 effort 控制:训练时与推理时机制详解 | 来源:@rasbt | 链接: | 仓库:无 | 论文:无 | 硬核点:详细解释 LLM 如何在推理时/训练时切换低/中/高度推理 effort,附完整技术文章(magazine.sebastianraschka.com),280K 播放,Jul 18…
知识库草稿 · 数据库 · 后端 · 云原生 · 推理工程 · 2026-07-25
| 分类 | 高价值条目 | 置信度 | 亮点 | ||||| | database | 向量数据库 2026 选型决策框架(Qdrant vs Milvus vs pgvector vs Pinecone) | ★★★★★ | 100+ 企业部署经验,6 大场景决策树 | | database | pgvector …
知识库草稿 · Substack 高价值精选 · AI Agent 生产失败模式 · A2A/CUA 协议评估
本轮从 The AI Engineer(theaiengineer.substack.com)精选两个高价值 Substack 条目,均为 AI 工程化视角,有真实生产数字和量化结论。 Gartner 预测:2027 年 40% 的 Agentic AI 项目将被废弃——不是因为模型不行,而是因为周围的系统没有被工程化…
工程实践筛选报告 · Jay · 2026-07-25
| 维度 | 内容 | ||| | 来源 | DevBlogs Microsoft · devblogs.microsoft.com/agentframework | | 发布时间 | 202606(BUILD 2026 期间) | | 核心内容 | Microsoft Agent Framework (MAF) 开源…
Fireship (YouTube) · RSS 摘要
史上最有趣的"hack"… 开源权重 AI 参数达到 2.8 万亿… 这家估值 120 亿美元的初创公司终于交付了产品… OpenAI 再次因窃取被起诉… 史上最具争议的重写版本已发布…
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时即进行验证,同时保持速度与适应性…… Aurora 1.5:扩展用于天气和地球系统应用的开放基础模型 — Aurora 1.5 在 Aurora 基础模型中新增 22 个变量、逐小…