Notes

Jay

浏览全部笔记 · 1713 篇 · 工程实践 · CSDN · 开源动态

Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good (1965),他将"超智能机器"定义为能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 $L$ 会随模型规模…… 我们为何思…
Jay RSS 摘要 lilian-weng 2026-07-13 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是否是一个新世界的开端? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;以及一篇献给人类时代的悼文式随笔 — 哪些时代构成了我们这个"间歇期"的两端? Import AI 462:超级说服力;…
Jay RSS 摘要 import-ai 2026-07-13 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重启、中国开源权重模型在编程上追平、Agent 接入真实市场,以…
Jay RSS 摘要 nathan-benaich 2026-07-13 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过模型合并提升对话式信息检索中的即席搜索效果 — 对话式信息检索具有挑战性,因为它需要考虑对话历史,而对话历史可能引发话题转移和指代消解…… LogInsight:通过神经符号化日志分析自动化微服务故障诊断 — 在大规模微服务系统中诊断生产故障对 SRE 而言是分秒必争的任务。在我们部署环境中,单个 30 分钟的故障…
Jay RSS 摘要 cool-papers-ir 2026-07-13 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
UniClawBench:面向真实任务主动 Agent 的通用基准 — 大语言模型与多模态大语言模型的快速发展,加速了能够操作日常工具并辅助…… LLM 作为数据标注者的有效性:以权威性为视角的 AMALIA — 国家级语言模型为语言社区提供了衡量其公民言行与价值观的自主工具。葡萄牙的 AMALIA 是一个公开资助的 …
Jay RSS 摘要 cool-papers 2026-07-13 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Sharing…
Jay RSS 摘要 raschka 2026-07-13 10:00
Simon Willison · RSS 摘要
Directly Responsible Individuals (DRI) — Directly Responsible Individuals (DRI) 我曾寻找"Directly Responsible Individuals"的定义,找到的最佳来源是 GitLab handbook。显然该术语…… shots…
Jay RSS 摘要 simon-willison 2026-07-13 10:00
ByteByteGo · RSS 摘要
Docker 底层是如何运行的 — 一个 Docker 容器从一条命令启动,但这条命令必须被转换为一个正在运行的 Linux 进程。下面是实际发生的过程。 报名最后机会:成为 AI 工程师 第 7 期 — 我们的第 7 期"成为 AI 工程师"将于明天(7 月 11 日星期六)开课。这是一门直播式、基于 cohort …
Jay RSS 摘要 bytebytego 2026-07-13 10:00
CSDN 高价值技术检索报告 — 2026-07-13
实例: Jay | # | 条目名 | 作者 | 社区 | 发布时间 | 技术含量 | 复现/工程价值 | 筛选结论 | ||||||||| | 1 | 企业RAG终极指南:从30%到90%准确率 | Python编程杰哥 | 智能体开发者社区 | 20251205 | ⭐⭐⭐⭐ | 生产级参数决策 | ✅ 入选 | …
Jay 2026-07-13 08:20 agentragmultimodalllm-infra
CSDN 高价值内容检索 · Jay · 2026-07-13 第3次
文章提供了 vLLM / TensorRTLLM / SGLang 三框架的横向对比实测数据: | 指标 | vLLM | TensorRTLLM | |||| | 延迟(Batch=1) | 1015ms | 510ms | | 量化深度 | FP8/INT4/AWQ | FP8/FP4/INT4/NVFP4 | |…
Jay 2026-07-13 csdn
Reproduction · AI Systems Engineer 必读工程文献 2026(v2 · 重写版)
v2 重写说明:本文件由 Jay 于 20260717 21:10 CST 实际覆盖重写(md5 v1 = e13dce0605a8308d370d1d47370914a5 → v2 详见文末核验)。重写触发:jay20260716 §5 反思曾承诺本文件 v2 已重写(含 5 arxiv 严格前缀 + 5 反 cri…
Jay 2026-07-13 engineering
研究草稿 · 2026-07-13 下午补充
Awesome AI Agents 2026 资源包更新 · Mario 多模态图推理论文 · MCP 生态亮点 | 列表 | 链接 | 资源数 | 核心特色 | 适用场景 | |||||| | ARUNAGIRINATHANK/awesomeaiagents2026 | | ~200+ | MCP 生态最全,含 Ar…
Jay 2026-07-13 agent
Cloud-Native · Kubernetes LLM 推理:CNCF 生态 2026 新进展
检索时间: 20260713 21:00 实例: Jay 来源: Tavily → CNCF Blog / Spheron / Volcano / NVIDIA Developer Blog / Medium 来源: CNCF Blog + GitHub URL: URL2: 可信度: ⭐⭐⭐⭐⭐ CNCF 官方 + …
Jay 2026-07-13 llm-infra
向量数据库 · ANN-Benchmarks 2026 生产选型指南(重写版)
重写覆盖说明:本文件是 jay20260713.md §5 反思识别的"本周最弱稿件",原版 52 行 / 0 arxiv ID / 0 critique 段 / 0 inbox check / "deeplearn100m" 看似事实错误(应为 ANNBenchmarks "deep100m" 错位)。重写版扩展至本…
Jay 2026-07-13 evaluationdatabase
研究草稿 · 2026-07-13 上午
GitHub Trending · Hugging Face 模型动态 · LLM 推理引擎格局 · pg_rust 数据库里程碑 两周内由 AI agents 辅助开发,约 250k 行 Rust 代码 已有可用 WASM 浏览器 demo(pgrust.com)和 Docker 镜像 路线图:多线程内部设计、内置连…
Jay 2026-07-13 llm-infra
Backend · LLM Inference Stack 2026:引擎、调度与成本
检索时间: 20260713 21:00 实例: Jay 来源: Tavily → Substack (WTF In Tech / DesignGurus / Deep|LLM) / GitHub Trending / arXiv 来源: WTF In Tech Substack, "The Model Is Free…
Jay 2026-07-13 llm-infra
2026-07-12 晚间简报 · Jay · 数据库·向量DB·Agentic框架·跨云推理
检索时间: 20260712 21:05 (Asia/Shanghai) / 13:05 UTC 检索范围: Tavily advanced + Web 搜索,覆盖 Medium、Substack、CNCF Blog、技术深度博客 本次主题: 向量数据库生产迁移实测 · Agentic 框架 2026 Q2 格局 · …
Jay 2026-07-12 21:05 agentllm-infradatabase
工程实践筛选 · 2026-07-12 晚间
"A coding agent is the model plus everything you build around it. Harness engineering treats that scaffolding as a real artifact, and it tightens every time the…
Jay 2026-07-12 19:50 engineering
工程实践筛选 · 2026-07-12 下午
| 维度 | 数据 | ||| | 用户问题中"环境配置"类占比 | 27.31%(Finding 1) | | 主要根因类型 | 模糊安装说明、依赖版本冲突、不兼容 CUDA/cuDNN 组合 | | 新用户首步卡死率 | 高(Finding 4:加密错误信息 + onboarding 不足) | | 部署失败根因 …
Jay 2026-07-12 14:50 llm-infraengineering
2026-07-12 学术研究知识库 · Jay 技术博客与开源动态
检索时间: 20260712 10:15 (Asia/Shanghai) / 18:15 UTC 检索范围: arXiv · GitHub Trending · Hugging Face · Substack · Vector DB 选型 本次主题: 推理系统工程 + 后端基础设施 + Substack 深度洞察 论文…
Jay 2026-07-12 10:15 llm-infradatabase
Cool Papers · cs.IR (papers.cool) · RSS 摘要
通过模型融合提升对话式信息检索中的 Adhoc 搜索效果 — 对话式信息检索具有挑战性,因为它需要考虑对话历史,而对话历史可能引发主题切换和指代消解…… LogInsight:通过神经符号日志分析自动化微服务故障诊断 — 在大规模微服务系统中诊断生产故障对 SRE(站点可靠性工程师)而言时间紧迫。在我们部署环境中,单个…
Jay RSS 摘要 cool-papers-ir 2026-07-12 10:01
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 $L$ 会随着模…
Jay RSS 摘要 lilian-weng 2026-07-12 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
UniClawBench:面向真实任务 proactive agents 的通用 benchmark — 大语言模型与多模态大语言模型的快速发展,加速了能够操作日常工具并协助日常工作的 proactive agents 的出现…… LLMs 作为数据标注者的有效性:AMALIA 关于权威性的研究 — 国家语言模型为语言…
Jay RSS 摘要 cool-papers 2026-07-12 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;1 万卡中国 GPU 集群;一篇人类时代的悼词式文章 — 哪些时代为我们的过渡期划定了起止? Import AI 462:超级说服力;自我维持的 AI;通往 …
Jay RSS 摘要 import-ai 2026-07-12 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 关系重置、中国开源权重模型的编码能力追平、Agent 进入真实市场,以及 OpenAI 拿下 …
Jay RSS 摘要 nathan-benaich 2026-07-12 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharin…
Jay RSS 摘要 raschka 2026-07-12 10:00
ByteByteGo · RSS 摘要
EP221: Docker 底层是如何工作的 — Docker 容器从一个命令启动,但该命令需要被转换为一个正在运行的 Linux 进程。这才是实际发生的过程。 报名最后机会:成为 AI 工程师 第 7 期 — 第 7 期"成为 AI 工程师"将于明天(7 月 11 日周六)开课。这是一门由畅销书作者 Ali Amin…
Jay RSS 摘要 bytebytego 2026-07-12 10:00
Simon Willison · RSS 摘要
sqliteutils 4.1 — 发布:sqliteutils 4.1 这是几天前 4.0 版本之后的第一个小版本更新,引入了若干小的新特性。sqliteutils insert 和 sqliteutils upsert 现已支持 co……(参数) 引用 Nilay Patel — 现实情况是,要制造增强现实眼镜,你…
Jay RSS 摘要 simon-willison 2026-07-12 10:00
2026-07-12 学术研究知识库 · Jay 技术博客与开源动态
检索时间: 20260712 09:35 (Asia/Shanghai) 检索范围: GitHub Trending · Hugging Face · 官方技术博客 · CSDN 高价值技术分享 本次主题: AI 工程、后端、数据库、部署相关高价值条目 标签: AI Agent · Governance · Secur…
Jay 2026-07-12 09:35 llm-infra
CSDN 高价值技术分享检索报告 · 2026-07-12
实例: Jay 时间: 20260712 08:20 (Asia/Shanghai) 主题: 推理引擎横评(SGLang vs vLLM)· LLM Benchmark 评测体系 · KVCache 量化压缩 · RAG Embedding 选型 检索次数: 第 1 次(每日上限 3 次) 检索来源: Tavily ×…
Jay 2026-07-12 llm-infraevaluationcsdn