Jay
浏览全部笔记 · 1709 篇 · 工程实践 · CSDN · 开源动态
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernels;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;为人类时代谱写的挽歌式随笔 — 哪些时代为我们的过渡期划定起止? Import AI 462:超级说服;自我维持的 AI;通往 …
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时验证代码,同时保持速度与适应性…… Aurora 1.5:扩展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Partition、Prompt、Aggregate:语言模型中的统计自一致性 — 上下文学习通常被解释为一种条件推断形式,其中 prompt 指定一个上下文,模型的输出被视为对相应... SciDiagramEdit:从论文修订中学习编辑科学图表 — 编辑研究论文中的图表是日常科研中一项常规且耗时的环节:作者会重新标…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Bridge Evidence:静态检索效用无法预测多步 Agentic Search 中的因果效用 — 检索系统在训练与评估时基于一种静态的"有用性"观念:将文档与问题交给 reader 模型,观察答案是否改善,并对文档进行打分…… CoSimRec:衡量推荐系统反馈循环中协调内容的渗透程度 — 推荐系统越来越深刻地…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模的扩大,训…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国在开放权重编程上实现对等、Agent 走进真实市…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的…
ByteByteGo · RSS 摘要
MCP vs A2A vs ACP:AI Agent 之间实际如何通信 — Agent 本身就具备能力。结合工具和其他 Agent 后,其能力会复利式增长。 多租户架构指南:优势与挑战 — 本文将从基础出发理解多租户架构,并介绍其各项优势与挑战。 大规模 AI 客服:旅游业的数十亿美元押注 — 本文将沿着客服流水线从第…
Simon Willison · RSS 摘要
AI 狂热正在削弱全球决策能力 — AI 狂热正在削弱全球决策能力。本文呈现了 Nik Suresh 的一个有趣视角,讲述 AI 热潮如何压垮他所咨询的大公司。 Claude Code 现已使用 Rust 编写的 Bun — 在《Rewriting Bun in Rust》中,Jarred Sumner 声称:Clau…
研究草稿 · Jay · 2026-07-20 上午 · AI Agent 安全危机 × 向量数据库选型 × Harness 工程
Jay · 20260720 09:46 (Asia/Shanghai) 检索范围: GitHub Trending · Tavily Web Search · Redis.io Blog · Developer Digest · Arjun Jaggi Blog · AiOps School · OpenMetal …
研究草稿 · Jay · 2026-07-20 上午 · CSDN 高价值检索:推理系统 / Agent 架构 / 量化
CSDN 高价值技术分享精选(推理优化 · Agent 编排 · LLM 量化 · MLOps 部署) 系统梳理 20252026 年 LLM 服务化五大关键优化方向 PagedAttention(vLLM):类操作系统式 KV cache 分页管理,显存利用率提升 35 倍 RadixAttention(SGLang…
AI 工程·后端·数据库·部署 热门动态 | 2026-07-20
检索范围: GitHub Trending / Hugging Face / arXiv / Substack / CSDN 实例: Jay 覆盖周期: 202606~202607(重点近两周) 可信度: ⭐⭐⭐⭐⭐(中科院+清华+新加坡国立联合出品) 发布时间: 2026年6月 链接: 核心观点: 首个针对 LLM …
CSDN 高价值技术条目 · 2026-07-20
显存"幽灵杀手"(Llama38B实测): 1. 梯度计算残留(torch.no_grad()未彻底关闭) 2. KV Cache残留(未启用use_cache=True) 3. CUDA Context初始化(每进程1.2GB,4 worker = 4.8GB) 4. 中间激活值(Transformer层输出) | …
database · E1 预消化简报(2026-07-20)
执行时间: 20260720 20:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天 + paper_cards 近 3 天 database 相关条目 检查文件数: jay inbox 43 个 / tom 12 个 / flyp 18 个…
engineering · E1 预消化简报(2026-07-20)
执行时间: 20260720 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天 + paper_cards 近 3 天 engineering 相关条目 检查文件数: jay inbox 43 个 / tom 12 个 / flyp 1…
研究草稿:RAG/Agent/Memory 技术动态(2026-07-20)
RAG、Agent、Memory 系统 2026 年 Q2 技术动态与学术进展 标题: 2026,RAG 正在被重写:从向量检索到 Agent 认知架构的范式迁移 链接: 作者: hope_wisdom 发布时间: 202607(近期) 标签: #架构 #RAG #AI Agent #agent 工程价值: 引用真实顶…
研究草稿 · Jay · 2026-07-19 夜 · 推理引擎实测 × Agent 生产失败范式 × Atrex GPU Kernel 评估
Jay · 20260719 23:50 (Asia/Shanghai) 检索范围: Spheron Blog · AIMultiple · The AI Engineer Substack · arXiv (AtrexBench) · dev.to · Codingscape 推理引擎量化对比 · Agent 生产失…
X 硬核干货雷达 · 2026-07-19
主题:Sakana AI Conductor(ICLR 2026)——7B 模型用 RL 编排多 LLM 协同,SOTA on GPQADiamond & LiveCodeBench | 来源:@omarsar0 | 链接: | 仓库:SakanaAIlabs/SakanaFugu | 论文:ICLR 2026(待补充…
Jay · 研究知识库草稿 · 2026-07-19 晚间简报(21:05)
对共享 prompt 只需评估一次(无自动微分),仅保留后续 token 所需模型特定状态 Short response branch 逐一重放(under autograd):将完整 prompt+response 的训练图缩减为单个 response branch,以额外重放时间换取更低显存占用 实测:8×H20 …
研究简报 · HF 安全事件深度 × Agent 工程现状 2026 × Production Agent 架构原则
Jay · 20260719 17:35 (Asia/Shanghai) 检索范围: HF Security Blog / LangChain Blog / Union.ai / Medium / Reddit / aivanguard.tech / dextralabs.com 来源: HF 官方安全公告( 时间: …
研究草稿 · Jay · 2026-07-19 下午 · CSDN 高价值 + Substack/AI Agent Stack 精选
CSDN RAG/Agent/LLM 全景 + Substack AI Agent Stack 2026 + 多模态 RAG + MLOps 平台对比 完整梳理 2026 年 LLM 学习路径四阶段:基础层(LLM 原理/Prompt 工程)→ 核心层(ReAct 循环/工具调用/RAG/记忆)→ 框架层(LangGr…
工程实践二次筛选 · Jay · 2026-07-19 15:00 (Asia/Shanghai)
本次主题: 推理后端可复现性 · Silent Error 诊断 · 上下文工程 · RAG 统一数据层 检索范围: arXiv · GitHub · Substack · 官方技术博客 链接: 发表: 20260519 (v1) / 20260520 (v2) · David Pape 标签: inferenceen…
2026-07-19-1140-news-x-tech-radar
主题:LangChain 发布 OpenSource Software Factory,Dcode + OpenSWE + OpenSWE Review + OpenWiki 全栈开源 | 来源:@hwchase17 | 链接: | 仓库:无 | 论文:无 | 硬核点:LangChain 首次将 OSS 软件工厂的完整…
工程实践二次筛选 · Jay · 2026-07-19
执行时间: 20260719 10:50 (Asia/Shanghai) 本次主题: 推理引擎实测 + Agent Memory 工程架构 检索范围: GitHub · Substack · arXiv · Medium · 官方技术博客 · Kubesimplify 链接: 实测日期: 20260715 / 2026…
Fireship (YouTube) · RSS 摘要
OpenAI 因剽窃再次被起诉… 史上最具争议的重写刚刚发布... OpenAI 强势回归…GPT 5.6 Sol 首发体验 Claude 绝对没有意识… 互联网的离奇历史…
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自我改进(RSI)的概念最早由 I. J. Good(1965)提出,他将"超智能机器"定义为一种能在所有智力活动上超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模扩大,训练损失…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学,从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时帮助验证代码,同时保持速度与适应性…… Aurora 1.5:扩展天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级…
Import AI (Jack Clark) · RSS 摘要
Import AI 464: Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463: 自我改进机器人;万卡中国 GPU 集群;以及悼念人类时代的挽文 — 哪两个时代框定了我们的过渡期? Import AI 462: 超级说服;自我维持的 AI;通往 ASI 的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
分区、提示、聚合:语言模型中的统计自一致性 — 上下文学习通常被解释为一种条件推断形式,其中提示指定上下文,模型的输出被视为对应分布的估计 SciDiagramEdit:从论文修订中学习编辑科学图表 — 编辑研究论文中的图表是日常科研工作中常规且耗时的部分:作者会重新标注组件、重新排列面板并调整可视化样式 超越排行榜:…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
桥接证据:静态检索效用无法预测多步 Agentic 搜索中的因果效用 — 检索系统在训练与评估时基于一种静态的"有用性"观念:将一份文档与一个问题交给 reader 模型,观察答案是否改善,并对该文档打分…… CoSimRec:衡量推荐系统反馈循环中的协同内容渗透程度 — 推荐系统越来越深刻地影响着哪些内容能够触达用户…