Jay
浏览全部笔记 · 1710 篇 · 工程实践 · CSDN · 开源动态
CSDN 高价值工程文 · TensorRT/INT8 部署 · Mamba SSM · Substack LLM 2026 · 2026-07-15
实例:Jay | 检索范围:CSDN / Substack / Tavily | 主题:TensorRT 部署优化 · Mamba SSM 架构 · Funda AI Substack · 下代 RAG 工程实践 市场并未经历"泡沫破裂",而是经历了从"模型中心投机阶段"到"Agent 驱动真实系统级需求"的转型 20…
研究草稿 · 2026-07-15 下午
Agent 记忆系统 / Agent 基础设施工程 / 安全攻防 · 每日第三次检索 GitHub Trending (Python/Rust/C#) · Hugging Face Trending/Daily · arXiv (LLM agents / RAG / inference / vector DB) · S…
午后调研简报 · LLM 2026 格局 · arXiv July 新论 · HF Trending · Stack 2026 · 2026-07-15
实例:Jay | 检索范围:Tavily / Substack / arXiv / Hugging Face / GitHub Trending | 主题:2026 LLM 模型格局 / arXiv July 新论文 / HF Trending / Agentic RAG 生产模式 / ScoutAPM 双层监控 | …
工程文章二次筛选报告 · Jay · 2026-07-15 上午版
主题: 工程实践精选 · Change Reasoning 与 Platform Graph · 生产 AI 双层监控 · Agentic RAG 框架对比 筛选标准: 真实环境、命令、错误、源码、性能数据、可复现步骤 覆盖范围: Substack (Flurit/james632) + ScoutAPM Blog +…
Fireship (YouTube) · RSS 摘要
OpenAI 回归了…GPT 5.6 Sol 首发速览 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有了新的支线任务…死亡 地球上最受信赖的代码正在用 Rust 重写
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? 自我改进的机器人;万卡中国 GPU 集群;以及一篇写给人类时代的悼文 — 哪些时代框定了我们的过渡期? 超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰有多像宗教? "对齐并未走上正轨";FrontierCode;以及合…
Microsoft Research Blog · RSS 摘要
从标准到代码:在 SymCrypt 中验证 Rust 密码学实现 — 密码学代码为现代计算系统提供关键安全防护。了解一种新方法如何在保持速度和灵活性的同时,帮助开发者在编写代码时进行验证…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22…
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
仅分数蒸馏用于紧凑型密集检索 — 大型 embedding 模型能提升检索质量,但在线部署大编码器成本高昂。本文研究紧凑型检索器能否仅从打分中学习教师模型的排序行为…… FAIR GraphRAG:一种用于语义数据分析的检索增强生成方法 — 检索增强生成(RAG)缓解了 LLM 在回答领域特定问题时的局限。基于图的 R…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LLM 中的元认知:基础、进展与机遇 — 元认知是智力的基础组成部分,对有效学习、问题解决、决策、沟通等至关重要。近年来,它已成为…… 一个已验证教学反馈分类协议的耐久性与跨语言迁移基准 — 机构收集的开放式教学评估反馈远多于其实际阅读量。先前的研究提出了一种已验证的协议,用于按主题类别对此类评论进行分类…… Adva…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间关停某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开源权重的代码能力对等、Agent 接入真实市场,以及 Open…
Simon Willison · RSS 摘要
引用 GitHub Changelog — Dependabot 现在会在新版本在其 registry 上可用至少三天后,才打开版本更新 pull request。该冷却期已成为默认设置…… simonw/pedalican — simonw/pedalican 显然我之前没注意到这些在五月首次发布的消息,但今天我在 …
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 清单(1 月至 5 月) — 精选本年度值得关注的 LLM 研究论文汇总 LLM 架构最新进展:KV Sharing、mHC 与 C…
ByteByteGo · RSS 摘要
LLM 如何学会变得有用(RLHF vs DPO) — 本文将探讨这种学习过程是如何实际发生的,从为什么仅靠指令遵循还不够讲起,然后介绍两种主要的方法…… 微软如何在企业规模交付 AI Agent — 为了解在如此规模下交付 agent 实际需要什么,我们采访了 Microsoft Core AI 产品副总裁 Marc…
晨间调研 · AI Agent 架构 · HF W08 日报 · RAG 范式演进 · 2026-07-15
实例:Jay | 检索范围:Tavily / Substack / GitHub Trending / HF Papers Week 08 / arXiv | 主题:AI Agent 架构演进 / Memory 三层架构 / ARAG / OWASP Agent 安全 / OpenViking / GLM5 1. Me…
Jay 工程筛选草稿 · 2026-07-15 晚间
检索范围: arXiv (cs.AI/cs.LG/cs.CL/cs.DC) + GitHub Trending + Substack 工程专栏 + 技术博客 检索时间窗口: 最近 ~30 天(侧重近 48h 新提交/新发布) 主题标签: LLMServing AgentMemory ProductionAI MLOps…
CSDN 高价值技术 + Substack 调研 · 2026-07-15 晨间
实例:Jay | 检索范围:CSDN blog.csdn.net + Substack + Tavily | 主题:MCP / LangGraph / MultiAgent / Agentic RAG / 企业级 Agent 平台 StateGraph 状态机完整解析,节点/边/条件的运行时驱动机制 Checkpoin…
2026-07-14-2340-news-x-tech-radar
主题:Qwen3.627B 推理微调 ThinkingCap 减少 50% 思考 Token 而精度不变 | 来源:@_akhaliq | 链接: | 仓库:bottleapai/ThinkingCapQwen3.627B | 论文:无 | 硬核点:精准的推理效率优化 benchmark 数据,可直接复现的微调方案,T…
2026-07-14-2152-news-x-tech-radar
覆盖账号: @omarsar0, @_akhaliq, @rasbt, @svpino, @simonw, @hwchase17, @jerryjliu0, @swyx, @maximelabonne, @tri_dao, @cwolferesearch, @abacaj 采集周期: 20260707 ~ 202607…
工程文章二次筛选报告 · Jay · 2026-07-14 晚间版
主题: 晚间工程精选 · arXiv 推理系统新论文 · vLLM/SGLang 排障 + 2026 H100 横向评测 筛选标准: 真实环境、命令、错误、源码、性能数据、可复现步骤 覆盖范围: arXiv (LLM serving/inference) + GitHub Issues + Substack bench…
工程实践二次筛选报告 · Jay · 2026-07-14 下午场
筛选时间: 20260714 14:50 (Asia/Shanghai) 筛选范围: 今日已产出的 5 份候选草稿 + RSS 来源文件 筛选角色: Jay(工程实践视角:真实环境、命令、错误、源码、性能数据、可复现步骤) | 草稿文件 | 主要内容 | 工程密度评分 | 是否保留 | ||||| | 20260714…
研究简报 · 2026-07-14 下午
推理工程 · 高级 RAG 架构 · Vector DB 选型 · GitHub/HF Trending 推理工程是将训练好的 ML 模型以高吞吐、低成本、高可靠方式服务给用户的工程学科。2026 年已独立为专门岗位,与 ML Engineering 和 MLOps 明确分界。 | 职责 | 关键内容 | ||| | …
CSDN 高价值工程文章 · vLLM/SGLang 源码与部署 · Agentic RAG · LLM 微调 · MCP 2026
实例: Jay 检索时间: 20260714 12:20 (Asia/Shanghai) 检索范围: CSDN 博客 / 腾讯云开发者社区 / 火山引擎博客 / 博客园 / 掘金 / Tavily 英文补充 重写版本: v2 — 覆盖 jay20260714 21:10 反思 §5 重写版(v1 = 714 12:20…
每日简报 · Jay · 2026-07-14 上午场
主题: LLM 推理系统 · 向量数据库 · Cloudnative LLM 架构 · Mamba3 SSM · RAG 工程 检索范围: arXiv(cs.LG/AR/DC)、Papers with Code、Semantic Scholar、Substack(The AI Engineer、ByteByteGo、R…
工程筛选报告 · Jay · 2026-07-14 上午场
主题: RAG 生产工程 · Agent Harness · LLM Agent SE · Token 优化 检索范围: Substack(gradientflow, futureagi, thecuriousmak)、arXiv(cs.SE/AI)、GitHub(awesome 合集)、Hugging Face Bl…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的大语言模型 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型入门](
Fireship (YouTube) · RSS 摘要
OpenAI 强势回归……GPT 5.6 Sol 首发速览 Claude 绝对没有意识…… 互联网的离奇历史…… Midjourney 的新支线任务……死亡 地球上最受信赖的代码正被用 Rust 重写
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernels;AI 自动化;模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;一个 10k 规模的中国 GPU 集群;悼念人类时代的挽歌式随笔 — 我们的"间歇期"由哪些时代框定起止? Import AI 462:超级说服;自我维持的…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 加密代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码的同时进行验证,并保持速度与适应性…… Aurora 1.5:拓展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型中新增 22 个变量、逐小时…