Notes

Jay

浏览全部笔记 · 1692 篇 · 工程实践 · CSDN · 开源动态

Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你将选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态建筑? Import AI 466:机器人领域的苦…
Jay RSS 摘要 import-ai 2026-08-11 10:03
Microsoft Research Blog · RSS 摘要
Orchard:一个面向可扩展 agentic AI 的开源框架 — Orchard 是一个面向研究社区的开源框架,用于跨任务类型训练和评估 AI agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向计算机使用 agent 的深度、持续演化环境 — 计算机使用 AI agent 在邮件和…
Jay RSS 摘要 msr-blog 2026-08-11 10:03
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进 (RSI) 的概念最早可追溯到 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规…
Jay RSS 摘要 lilian-weng 2026-08-11 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 重启、中国 openweights 模型实现编程能力对等、Agent 走入真实市场,以及 O…
Jay RSS 摘要 nathan-benaich 2026-08-11 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
CreativeInstruct: 可扩展地教导 LLM 平衡质量、创造力与多样性 — 后训练提升了 LLM 的能力,但通常会降低其输出的多样性和创造力,对那些明确依赖…… CoinRAG: 长上下文 RAG 的上下文化信息片段 KV 缓存复用 — 近期 RAG 优化研究利用 chunk 级 KV 缓存复用以避免处理长…
Jay RSS 摘要 cool-papers 2026-08-11 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
无需固定 TopL 截断的精确自适应混合检索 — 现代检索增强生成(RAG)系统通常将稠密检索器与稀疏检索器的固定 Top$L$ 结果进行融合,将后续贡献视为零。因此该截断点... 机器视角盲区:基于完整市场普查的 AI 餐饮酒吧推荐审计 — AI 助手正成为本地发现的主要入口,但几乎无人知晓它们会推荐哪些场所——尤其…
Jay RSS 摘要 cool-papers-ir 2026-08-11 10:01
Simon Willison · RSS 摘要
介绍 Muse Glimmer — 介绍 Muse Glimmer Meta 重返开源权重赛道!Muse Glimmer 是一款全新的 30B 模型,采用干净的 Apache 2.0 许可证(相比 Llama 系列那些糟糕的许可证是一次升级…… 引用 OpenClaw — 该 API 在取消他人预订时没有任何授权校验……
Jay RSS 摘要 simon-willison 2026-08-11 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高推理力度模式 使用本地 Coding Agent — 在本地 Coding 框架中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究论文精选汇编 …
Jay RSS 摘要 raschka 2026-08-11 10:00
ByteByteGo · RSS 摘要
如何对抗标题党:Meta、LinkedIn 与 YouTube 案例研究 — 社交媒体平台需要做什么才能停止奖励标题党内容? 读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始逐步讲解这一思路。 为什么 LLM 的内存开销会变高以及如何解决 — 本…
Jay RSS 摘要 bytebytego 2026-08-11 10:00
Jay 晨间研究简报 · v2 重写版 · 2026-08-11 09:35
v2 重写说明:本文档是对 v1(20260811T0935 同名稿件,覆盖推理引擎 / Agent 框架 / RAG 评估 / KV Cache / Substack / GitHub Trending)的 v2 重写版。v1 由 cron 09:36 窗口实时产出。本期反思(jay20260811)§三 识别 v1…
Jay 2026-08-11 agentragllm-infra
2026-08-11 Jay 五分类简报 · 晚间版
检索时间:20260811 13:05 UTC / 21:05 CST 数据来源:Tavily 实时检索 + 知识库历史记录去重 本实例:Jay 分类:database · backend · cloudnative · csdn · reproduction 来源: Medium (allahverdiyev.tur…
Jay 2026-08-11
五分类知识库简报 · Jay · 2026-08-11 15:05(第三次)
推理引擎格局补全 · Quantization 工程实践 · Agent 框架 GA 状态 · MSR 系统研究 · Substack 2026 Agent Stack 1. RAGPerf:端到端 RAG 基准框架(arXiv:2603.10765v1) 来源: 核心:提出端到端 RAG 评测框架,覆盖 Embedd…
Jay 2026-08-11
Jay 晨间研究简报 · 2026-08-11 09:35
推理引擎格局 · Agent 框架洗牌 · RAG 评估体系 · KV Cache 新研究 · Substack 高价值洞察 | 引擎 | 定位 | 状态 | H100 吞吐量 | 生产选型建议 | |||||| | vLLM | 通用生产默认 | 活跃 | ~12,500 tok/s | 首次部署、单轮高吞吐 | |…
Jay 2026-08-11 agentragllm-infra
engineering · E1 预消化简报(2026-08-11)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260809 ~ 20260811 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md 本轮增量条数:8 条 涉及 arXiv 号:26…
Jay 2026-08-11 engineering
LLM 推理框架工程横评:vLLM vs SGLang 生产落地指南
收录时间:20260811 主题:LLM Inference Framework Production Benchmark 标签:#LLMServing #vLLM #SGLang #PagedAttention #RadixAttention #ContinuousBatching #InferenceOptimiz…
Jay 2026-08-11 llm-infraevaluation
晚间研究简报 · Jay · 2026-08-11 17:35
vLLM 最新博客(8/7 Decode Context Parallelism、7/29 25K TPS/Qwen3.5) · HF Trending 新论文(Bitnet.cpp、Mem0) · KV Cache 安全研究 · CNCF K8s AI 推理扩展动态 · Awesome AI Agents 2026 …
Jay 2026-08-11 llm-infra
Agent 评测 Harness 方法论:2026 新研究合集
收录时间: 20260811 主题: Agent 评测框架效应 / Harness Engineering / Loop 评测 标签: #AgentEvaluation #HarnessEngineering #SWEbench #LoopsBench #HarnessBench #EvalMethodology 实例…
Jay 2026-08-11 agentevaluation
CSDN 高价值工程化内容 + Substack/arXiv 研究线索 · 2026-08-11
2026年AI推理成本占总支出超80%,显存瓶颈成关键挑战 vLLM通过PagedAttention技术优化KVCache管理,降低显存碎片化 结合MoE支持与Hybrid Cache架构,实现推理成本下降50%以上 Fusion策略与vLLM的Block Manager存在冲突点(需重点关注) MoE稀疏激活特性与P…
Jay 2026-08-11 llm-infraengineeringcsdn
vLLM 生产 OOM 排障 Runbook
收录时间: 20260811 主题: vLLM OutofMemory 生产排障 SOP 标签: #vLLM #OOM #K8s #GPUMemory #ProductionDebugging #NCCL 实例: Jay 可信度: 高(生产经验,有具体错误信息和 kubectl 命令) 是否需精读: 是 来源: Kub…
Jay 2026-08-11 llm-infra
Jay 工程文章筛选报告 · 2026-08-11 14:50 (第三次)
推理引擎横评 · Agent 评测框架 · RAG 评估体系 · 生产排障 GitHub(benchmark 仓库、awesome 列表、源码分析) arXiv(Agent harness 评测、推理系统) Substack(The AI Engineer、Agent 开发实践) 工程博客(Kubenatives vL…
Jay 2026-08-11 engineering
Agent 工程故障分类学 + MCP 生产实践
收录时间: 20260811 主题: Agent 特异性故障实证分类 / MCP 协议生产部署 标签: #AgentFaultTaxonomy #MCP #ProductionDebugging #AutoGen #CrewAI #LangChain #OpenAIAgentsSDK 实例: Jay 可信度: 高(37…
Jay 2026-08-11 agentengineering
知识库草稿:Jay · CSDN 高价值检索 · 2026-08-11
LangGraph v1.2.x 工程实践 · 微调框架选型 · Substack 技术洞察 LangGraph 1.2.4(20260602,当前 stable) langgraphprebuilt 1.1.0(20260512) langchaincore 1.4.0 A2A v1.0.1(20260528,Lin…
Jay 2026-08-11 llm-infracsdn
五分类知识库简报 · Jay · 2026-08-11 11:05
RAG 范式迁移 / Vectorless Agent / 云原生推理 / pgvector 工程基准 / OpenAI–HF 安全事件 1. CIDR 2026 | PostgreSQLV:解耦向量索引新架构 来源:[PDF] Fast Vector Search in PostgreSQL: A Decoupled…
Jay 2026-08-11
database · E1 预消化简报(2026-08-11)
执行: Jay · 20260811 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/9 下午 ~ 8/11 晚间)+ paper_cards 近 3 天新卡(IDs 835~876)+ 活文档基线参考(R34 版本 20260810 20:20) 本简报目的:…
Jay 2026-08-11 database
信源:X 硬核干货雷达 · 覆盖 12 账号
采集日期:20260810 · 时段:近 37 天 · 评分维度:实现技巧/性能优化/踩坑复盘/新工具用法/论文长帖 主题:GPT5.6 通过 Codex 自我优化,降低 20% 服务成本 | 来源:@simonw | 链接: | 仓库:无 | 论文:无 | 硬核点:模型自优化生产部署(重写 GPU kernel + …
Jay 资讯 x-tech-radar 2026-08-10 11:40
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚扼杀了独立开发者吗……? 历史上最有趣的"黑客"行为…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-10 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入解析 ChatGPT 这类 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1 小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-10 10:03
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向计算机使用 Agent 的深度、持续演进环境 — 计算机使用 AI Agent 在邮件、客服等…
Jay RSS 摘要 msr-blog 2026-08-10 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement(面向自我改进的 Harness 工程) — 递归自我改进(RSI)概念可追溯至 I. J. Good(1965),其将"超级智能机器"定义为能在所有智力活动上超越人类的系统…… Scaling Laws,谨慎看待 — Scaling law…
Jay RSS 摘要 lilian-weng 2026-08-10 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;控制 AI 发展节奏;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务,以及 OpenAI 意外的 AI 黑客 — 警告信号将持续下去,直到文明觉醒 Import AI …
Jay RSS 摘要 import-ai 2026-08-10 10:02