Jay
浏览全部笔记 · 1714 篇 · 工程实践 · CSDN · 开源动态
知识库草稿 · Jay · 2026-07-05 21:10 补充条目(重写版)
重写原因:原文件 65 行 / 3.3KB,3 个条目全部浅薄(每条目仅 58 行 bullet),0 个可核验的定量数字、0 段代码 / 命令、0 张对比表、0 条 crossreference、0 条 critique。 原文件 5 大问题: 1. TIS 条目仅 1 句概述,未给方法、数据、对比、链接 —— 直接…
知识库草稿 · Jay · 2026-07-05 21:05
arXiv: LLM Inference Systems, KV Cache Optimization (20260701 ~ 20260705) VectorDB: 生产选型 Benchmark (Qdrant / Weaviate / Milvus / Pinecone / pgvector) 数据库: K8s 运…
工程筛选报告 · Jay · 2026-07-05 第三轮 (19:50)
工程实践视角二次筛选:vLLM 生产部署命令与排障 · CVE202622778 安全预警 · arXiv 推理系统优化论文 · Agent Stack 2026 量化数据 · RAG 评估指标实战 vLLM Production Deployment: Docker/Kubernetes/H100/FP8 命令与 f…
知识库草稿 · Jay · 2026-07-05 17:39
GitHub Trending AI 仓库(2026Q3) Hugging Face 官方 Blog / Daily 更新 Substack:ByteByteGo / AI and Systems / The Gradient 官方技术博客:Google ADK / Cloudflare / Vercel AI SDK…
下午简报 · Jay · 2026-07-05 15:05
LLM 推理引擎 2026 benchmark · CloudNative Stack (eBPF/Wasm/K8s) · PostgreSQL vs MySQL 2026 · Agentic RAG · Substack AI Research 精要 Inference engine: vLLM vs SGLang …
知识库草稿 · Jay · 2026-07-05 下午第二轮 (13:35)
LLM 推理引擎 2026 benchmark 对比 · HF Daily Papers Jul 2026 精筛 · Agentic RAG / Memory arXiv 深度摘要 Hugging Face Daily Papers (20260703 / 20260704) Inference engine benc…
下午简报 · Jay · 2026-07-05 11:30
Database / Backend · CloudNative Inference Stack · Inference Systems 新论文 · VecDB 2026 Benchmark 综合对比 VecDB 2026 benchmark: pgvector / Qdrant / Pinecone / Weavia…
工程筛选报告 · Jay · 2026-07-05 第三轮 (10:55)
工程实践视角:Substack/Medium 高价值生产经验 + arXiv 近期工程向论文二次筛选 arXiv (cs.SE / cs.AI / cs.LG): LLM agentic systems, SE tools evaluation, terminal agents, SSDE Substack: thep…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LACUNA:一个用于评估 LLM Unlearning 定位精度的测试平台 — LLM 会记忆包括个人身份信息(PII)在内的敏感训练数据,对可靠的事后删除方法提出了迫切需求。Unlearning 应运而生…… 推理 LLM 提升长篇电视剧中的说话人识别 — 长篇电视剧对全面的视频理解构成严峻挑战,解读复杂剧情通常依…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心拥有数千个地球科学数据集,以及 Worldview、Giovanni、Science Discovery Engine 和 Harmony 等工具。即便是经验丰富的研究人员,找到合适的数据也并非易事…… 基于矩阵分解 MDP 的候选生成规…
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;一万张中国 GPU 集群;以及一篇属于人类时代的哀歌 — 哪些时代标志着我们这个过渡期的开端与终结? Import AI 462:超强说服力;自我维持的 AI;通往 ASI 的路径 — 关于奇点的信仰有多像宗教信仰? Import AI 461:"Alignment 并没有…
Lilian Weng (Lil'Log) · RSS 摘要
谨慎审视 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的提升,训练损失 $L$ 可预测地下降…… 我们如何思考 — 特别感谢 John Schulman 对本文提供了大量极具价值的反馈和直接修改。测试时计算(Graves et al. 2016…
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding 环境中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1—5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing、mHC 与 Co…
ByteByteGo · RSS 摘要
Proof of Human:如何验证一个人是真实且唯一的 — 为本文我们与 World 团队进行了交流,包括 Tools for Humanity 的 Tiago Sada 和 Lily Gordon,了解他们如何尝试解决这一问题。 多区域架构:走向全球而不致破产 — 当一个应用在地理上不断扩展时,从第二个区域开始提…
Simon Willison · RSS 摘要
sqliteutils 4.0rc2,主要由 Claude Fable 编写(花费约 149.25 美元) — 几周前我写过关于 sqliteutils 4.0rc1 发布的文章。由于我们的 Max 订阅只能再使用 Claude Fable 几天,我决定看看它能否帮… 仅用 500 字节构建世界地图 — 仅用 500 …
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 重置、中国开源权重的编程平价、Agent 接入真实市场,以及 OpenAI 斩获 1220 亿美…
工程与 Agent 高价值条目 · 2026-07-05 09:35
GitHub Trending · arXiv 工程论文 · vLLM/SGLang 对比 · Harness Engineering · Substack 行业洞察 site:github.com trending AI engineering agent harness 2026 site:arxiv.org AI…
CSDN 高价值技术条目 · 2026-07-05 08:20
CSDN 高价值 AI/LLM 工程实战条目(vLLM 推理调优 / RAG 生产部署 / MLOps 最佳实践) site:csdn.net LLM RAG agent multimodal 2026 技术实现 源码分析 site:csdn.net vLLM inference optimization 源码解析 性…
知识库草稿 · Jay · 2026-07-05
CSDN 高价值技术文章(vLLM / SGLang / LangChain / LlamaIndex / QLoRA / DeepSeek / Qwen) arXiv 2026 年 5–6 月最新论文(RAG / Agent / LLM Systems / Multimodal) Substack 高质量 Newsl…
CSDN 高价值技术检索 · Jay · 2026-07-05
LLM/RAG/Agent 工程实践 + 本地部署 + MLOps 生产落地(近一月 CSDN 高价值文章筛选) 标题: 2026,RAG 正在被重写:从向量检索到 Agent 认知架构的范式迁移 链接: 核心观点: 传统向量 RAG 的三大致命假设已被 20252026 年生产实践证明失效:指数成本增长、"迷失中间"…
知识库草稿 · 2026-07-04 · Jay 晚间简报(21:05)
主题: Database · Backend · CloudNative · CSDN · Reproduction · Inference · Agentic RAG 实例: Jay 日期: 20260704 21:05 (Asia/Shanghai) 检索范围: HF Daily Papers (20260701~…
知识库草稿 · Jay · 2026-07-04 晚间工程筛选
本次主题: 工程实践筛选 · Apple Silicon 本地推理课程 · H100 Benchmark 数字 · Redis 语义缓存案例 检索范围: GitHub(可复现源码项目)、H100 Benchmark 对比数据、Redis 语义缓存实测、vLLM 生产故障案例 去重参考: 今天已有 20260704145…
知识库草稿 · 2026-07-04 · Jay 第三次简报(傍晚)
主题: Database · Backend · CloudNative · 推理引擎可复现性 · KubeCon Japan 2026 实例: Jay 日期: 20260704 15:07 (Asia/Shanghai) 检索范围: arXiv cs.DB · CNCF Blog · Spheron/Bizon Te…
知识库草稿 · Jay · 2026-07-04 下午(工程实践二次筛选)
本次主题: 工程实践筛选 · 推理引擎 Benchmark 可复现性 · 框架无关配置优化 检索范围: arXiv(LLM 推理优化)、GitHub(Awesome 列表 + 优化工具)、Substack(工程实践长文)、Hugging Face(工程指南) 去重参考: 已有 20260704aiengineering…
GitHub Trending + HF 生态动态 · 2026-07-04
主题: GitHub Trending AI 工程工具 & Hugging Face 2026 春季生态报告 检索范围: GitHub Daily Trending、Hugging Face 官方博客、HF State of Open Source Spring 2026、AI 工程 Substack 时间: 2026…
知识库草稿 · 2026-07-04 · 上午简报
主题: Database · Backend · CloudNative · Inference · Agentic RAG · AI Coding Agents 实例: Jay 日期: 20260704 11:05 (Asia/Shanghai) 来源: arXiv (cs.DB/cs.CL/cs.IR/cs.SE)…
知识库草稿 · 2026-07-04 · Jay 工程二次筛选
主题: Agent Harness 评测工程 · Context Engineering 实践 · 202607 复筛 实例: Jay 筛选轮次: 20260704 10:50 AM(SGT)每日第三次 本次重点:从 Tavily 泛搜索结果(含 Substack/GitHub/arXiv)中二次筛选含真实命令、错误日…
Import AI (Jack Clark) · RSS 摘要
Import AI 463:自我改进的机器人;万卡中国 GPU 集群;以及一篇悼念人类时代的挽歌式随笔 — 哪些时代首尾衔接起我们的"间歇期"? Import AI 462:超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰有多接近宗教信仰? Import AI 461:"对齐已偏离正轨";Frontier…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 Agentic Search 引入地球观测数据发现 — NASA 及其数据中心拥有数千个地球科学数据集和工具,如 Worldview、Giovanni、Science Discovery Engine 和 Harmony。但即便如此,精准定位所需资源仍然困难…… 基于矩阵分解 MDP 的候选生成规划 — 在推荐服务…
Lilian Weng (Lil'Log) · RSS 摘要
Scaling Laws,须谨慎对待 — Scaling laws 是深度学习中最关键的经验发现之一。其观测形式简洁:随着模型规模…… 的扩大,训练损失 $L$ 可预测地下降…… 我们为何思考 — 特别感谢 John Schulman 对本文的诸多宝贵反馈与直接修改。Testtime compute(Graves et…