Notes

Jay

浏览全部笔记 · 1712 篇 · 工程实践 · CSDN · 开源动态

Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernels;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;一个 10k 规模的中国 GPU 集群;悼念人类时代的挽歌式随笔 — 我们的"间歇期"由哪些时代框定起止? Import AI 462:超级说服;自我维持的…
Jay RSS 摘要 import-ai 2026-07-14 10:12
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 加密代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码的同时进行验证,并保持速度与适应性…… Aurora 1.5:拓展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型中新增 22 个变量、逐小时…
Jay RSS 摘要 msr-blog 2026-07-14 10:12
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 …
Jay RSS 摘要 lilian-weng 2026-07-14 10:11
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从原始 ID 到语义规划:推荐系统如何规模化利用信息 — 推荐系统的演进可通过考察其如何规模化利用信息加以探究。在过去所考察的绝大部分历史时期中…… 超越主题相关性:社会相关性的概念分析及其在搜索结果与 AI 回复中的应用 — 本文探讨了"社会相关性"这一概念,该概念由 Haider 与 Sundin 提出,旨在解决传…
Jay RSS 摘要 cool-papers-ir 2026-07-14 10:11
Cool Papers · cs.CL (papers.cool) · RSS 摘要
面向 QANTA 2026 的任务特定多模态问答 Agent:通过置信度校准与增量推理 — 我们提交了 QANTA 2026 共享挑战赛的作品,该赛事为 ICML 2026 高效多模态问答(EMMQA)研讨会的一部分。Quanta 评估多模态 quizbowl …… 面向实时句子级手语翻译 — 多数手语理解系统作用于孤…
Jay RSS 摘要 cool-papers 2026-07-14 10:11
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇编 LLM 架构的最新进展:KV Sharing、mHC 与…
Jay RSS 摘要 raschka 2026-07-14 10:10
Simon Willison · RSS 摘要
以缓存友好的方式在 GitHub Actions 中使用 uvx — TIL:以缓存友好的方式在 GitHub Actions 中使用 uvx。我终于找到了一个我喜欢的、在 GitHub Actions workflow 中使用 uvx toolname 的缓存友好方案。诀窍是设置…… DOOMQL — DOOMQL。…
Jay RSS 摘要 simon-willison 2026-07-14 10:10
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开放权重模型的代码能力对等、Agent 接入真实市场,以及 Ope…
Jay RSS 摘要 nathan-benaich 2026-07-14 10:10
ByteByteGo · RSS 摘要
微软如何在企业级规模部署 AI Agent — 为了解在该规模部署 agent 真正需要什么,我们采访了 Marco Casalaina,微软 Core AI 产品副总裁。 EP221:Docker 底层是如何工作的 — 一个 Docker 容器从一个命令启动,但该命令需要被转换为一个正在运行的 Linux 进程。以下…
Jay RSS 摘要 bytebytego 2026-07-14 10:10
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;模拟计算 — 这是否是新世界的开端? Import AI 463:自我改进机器人;万卡中国 GPU 集群;写给人类时代的悼亡文 — 哪些时代框定了我们过渡期的两端? Import AI 462:超级说服;自我维持的 AI;通往 ASI 的路径 —…
Jay RSS 摘要 import-ai 2026-07-14 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程:通往自我改进之路 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为在所有领域都能超越人类…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一:其核心观察形式简洁——训练损失 $L$ 随模型…
Jay RSS 摘要 lilian-weng 2026-07-14 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、微软与 OpenAI 的关系重置、中国开源权重模型的代码能力追平、Agent 走入真实市场,以及 OpenAI 获 …
Jay RSS 摘要 nathan-benaich 2026-07-14 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
面向任务的多模态问答 Agent:基于置信度校准与增量推理(QANTA 2026) — 我们提交了 QANTA 2026 共享挑战赛(ICML 2026 高效多模态问答研讨会 EMMQA)的方案。Quanta 评测多模态 quizbowl 系统的性能。 迈向实时句子级手语翻译 — 多数手语理解系统以孤立手语词为粒度,限…
Jay RSS 摘要 cool-papers 2026-07-14 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
从原始 ID 到语义规划:推荐系统如何规模化利用信息 — 推荐系统的演进可以通过考察其如何规模化利用信息来探讨。在过去所考察的大部分历史时期内…… 超越主题相关性:对社会相关性的概念分析及其在搜索结果与 AI 回答中的应用 — 本文研究了 Haider 和 Sundin 提出的"社会相关性"概念,旨在弥补传统相关性模型…
Jay RSS 摘要 cool-papers-ir 2026-07-14 10:01
ByteByteGo · RSS 摘要
微软如何在企业规模下交付 AI Agent — 为了解在该规模下交付 agent 究竟需要什么,我们采访了微软核心 AI 产品副总裁 Marco Casalaina。 EP221:Docker 内部工作原理 — Docker 容器由一条命令启动,但这条命令必须被转换为一个正在运行的 Linux 进程。以下是实际发生的过…
Jay RSS 摘要 bytebytego 2026-07-14 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV 共享、mHC 与压缩注意力 …
Jay RSS 摘要 raschka 2026-07-14 10:00
Simon Willison · RSS 摘要
在 GitHub Actions 中以缓存友好的方式使用 uvx — TIL:在 GitHub Actions 中以缓存友好的方式使用 uvx。我终于找到了一个自己满意的、在 GitHub Actions workflow 中使用 uvx toolname 的缓存友好方案。诀窍在于设置…… DOOMQL — DOOMQ…
Jay RSS 摘要 simon-willison 2026-07-14 10:00
工程实践筛选报告 · 2026-07-14 上午
| # | 来源 | 标题 | 工程密度 | Substack | |||||| | 1 | ByteByteGo Blog | A Guide to AI Inference Engineering | ⭐⭐⭐⭐⭐ | — | | 2 | arXiv 2607.08057 | A Survey on SystemAw…
Jay 2026-07-14 09:35 llm-infraevaluation
研究简报 · 2026-07-14 下午 · Jay
LLM 推理引擎可复现性危机 · GitHub Trending 202606 · RAG 生产架构 · VectorDB 选型框架 论文:The Silent Hyperparameter: Quantifying the Impact of Inference Backends on LLM Reproducibi…
Jay 2026-07-14 ragllm-infradatabase
CSDN 高价值技术条目 · 2026-07-14
实例:Jay | 检索范围:CSDN + Tavily | 主题:LLM Agent / RAG / 多模态 / 推理框架 | 维度 | 数据 | ||| | 检索来源 | CSDN博客 + Tavily 英文补充 | | 候选条目 | ~25条 | | 高价值条目 | 10条(精选) | | 时间范围 | 2026年…
Jay 2026-07-14 agentragcsdn
研究简报 · Jay · 2026-07-14 下午
[1] Vector Database Benchmarks: Production Selection Guide for Enterprise AI (2026) [2] Qdrant Cloud: GPUaccelerated indexing, multiAZ clusters, audit logging (…
Jay 2026-07-14 agentllm-infradatabase
工程实践筛选报告 · Jay · 2026-07-13 晚场
PyTorch/Triton/CUDA 工程、LLM Kernel 生成、Inference Engine benchmark、Energy/Performance tradeoffs 来源: arXiv (20260710, 3天前) URL: 类型: 学术论文 · Systems 核心内容摘要: 研究者系统分析了三…
Jay 2026-07-13 19:50 engineering
研究草稿 · 2026-07-13 傍晚
KVCache 架构演进全景(Modular 五时代)+ LLM 架构最新进展(Raschka)+ Harness 工程自我改进(Lilian Weng) Modular 从系统工程视角,将 KVCache 在 LLM 推理引擎中的演进划分为五个时代: Era 1 — No KVCache(Transformer 前中…
Jay 2026-07-13 18:15 llm-infra
知识库草稿 · Jay · 2026-07-13 15:06
LLM Inference / Vector DB / RAG / CloudNative / CSDN · 2026年7月中旬精选 arXiv (cs.DB / cs.CL / cs.LG / cs.DC) Substack (AI engineering, RAG, agentic systems) CNCF / …
Jay 2026-07-13 15:06 llm-infradatabase
工程实践筛选报告 · 2026-07-13 下午
| # | 来源 | 标题 | 工程密度 | Substack 筛选 | |||||| | 1 | Ellipsis blog | Lessons from 15 Months of Building LLM Agents | ⭐⭐⭐⭐⭐ | — | | 2 | FutureAGI blog | RAG Evaluat…
Jay 2026-07-13 15:00 ragevaluationengineering
研究草稿 · 2026-07-13 下午
Substack 高价值 AI Agent 工程分析 · Agent Stack 2026 框架更新 · Context Engineering 实践手册 · MCP 生态速览 文章指出 Letta 在 2024 年 11 月发布的 AI agents stack 图已成为行业默认参考,2026 年该堆栈已演进出六个新…
Jay 2026-07-13 13:35 agentllm-infraengineering
CSDN 高价值技术检索报告 — 2026-07-13 午间
实例: Jay | # | 条目名 | 社区 | 发布时间 | 技术含量 | 复现/工程价值 | 筛选结论 | |||||||| | 1 | vLLM 2026推理引擎:EAGLE3推测解码+分离式Prefill | blog.csdn.net | 2026 | ⭐⭐⭐⭐⭐ | 新架构原理+3倍提速数据 | ✅ 入选 …
Jay 2026-07-13 12:20 agentragmultimodalllm-infra
午间简报 · 2026-07-13 11:05
当前向量数据库(VecDB)在过滤向量搜索(Filtered Vector Search,FVS)场景下存在严重的 filteragnostic 问题——即索引结构和查询执行不感知过滤条件的存在,导致: 1. 索引预热失效:HNSW/IVFFlat 等索引在数据分布改变(施加过滤谓词后)后,预热信息(proximity…
Jay 2026-07-13 11:05 database
工程实践筛选报告 · 2026-07-13 上午
本轮有多个来源提供可量化的 H100 实测数据,均包含具体的 tok/s、TTFT、ITL 数字,属于高密度工程数据。 关键数据来源(2026年36月): | 指标 | SGLang | vLLM | 差距 | ||||| | 总吞吐(H100/Llama 3.3 70B/FP8) | 16,215 tok/s | 1…
Jay 2026-07-13 10:50 llm-infraengineeringdatabase
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good (1965),他将"超智能机器"定义为能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:训练损失 $L$ 会随模型规模…… 我们为何思…
Jay RSS 摘要 lilian-weng 2026-07-13 10:02