Jay
浏览全部笔记 · 2891 篇 · 工程实践 · CSDN · 开源动态
CSDN 高价值技术条目 · 2026-10-04
主题: LLM RAG Agent 推理部署 微调框架 20252026 工程实践 检索范围: blog.csdn.net / bbs.csdn.net · AI · LLM · RAG · Agent · vLLM · SGLang · LangChain · LLaMAFactory · GraphRAG · MC…
信源:X 硬核干货雷达 · 覆盖 12 账号
采集窗口:20260927 ~ 20261003 | 撰写:20261003 主题:OmniIO Skills——让你的 coding agent 成为全模态原生 Agent 的即插即用 MCP skill 框架 | 来源:@_akhaliq | 链接: | 仓库:any2anymllm/OmniIOSkill | 论…
工程二次筛选 · 真实错误/命令/实测数据专项 · 2026-10-03
主题: 工程文章二次筛选——聚焦含真实错误信息、可复现命令、实测 benchmark 的高工程价值条目 检索范围: Eric J. Ma Blog、BuildMVPFast、DEV Community、Spheron Network、DeepInfra、vLLM Forum、Medium 去重说明: 下午/傍晚已有 V…
晚间补充 · Agent Memory 分层框架 / HF Open Models 2026 生态位 / 自托管 VecDB+LLM GPU 共置实操 · 2026-10-03
主题: Agent Memory 三层架构精析、HF 开源模型格局(Qwen 生态位)、自托管 VecDB+LLM GPU 共置部署路径 检索范围: The AI Engineer Substack、Hugging Face Blog、Spheron Network、Label Studio ML Blog 时间戳: …
下午简报 · VecDB 基准 / 推理引擎对比 / eBPF 云原生 / MCP 生态 / RAG 评估体系 · 2026-10-03
主题: 向量数据库量化选型、LLM 推理引擎生产对比、云原生 eBPF 2026 状态、MCP 生态爆发、RAG 评估体系全貌 检索范围: Tavily (2026 Q4 最新数据)、GitHub Trending、Label Your Data、Braintrust、The New Stack、ranksquire.…
工程筛选 · Agent 框架评测量化数据 + 评估成本基准 · 2026-10-03
主题: Agent 框架生产性能量化基准 / Agent 评测成本实测数据 检索范围: GitHub Trending、arXiv (BenchAgent/AgentAtlas/HAL/CCBench)、OpenRouter benchmarks、OptiLLM 时间戳: 20261003 14:50 CST 来源: …
工程筛选 · Addy Osmani LLM 工作流 + AI Engineer 职位技能图谱 · 2026-10-03
主题: 工程工作流实践 + 职位技能需求实证分析 检索范围: Substack(Addy Osmani、McKay Johns)、dataskew.io(职位数据分析) 时间戳: 20261003 14:50 CST 专栏: Addy Osmani(addyo.substack.com) 标题: My LLM codi…
AI 工程 · Substack + HF 季报 + RAG 新范式 · 2026-10-03 下午
主题: Agent Stack 2026 六层架构、HF 开源生态 Q3 观察、Agentic RAG 演进、Block Goose MCP 案例 检索范围: Substack(The AI Engineer、Gradient Flow)、Hugging Face Blog、GitHub Trending、arXiv …
2026-10-03-1140-news-x-tech-radar
本轮采集窗口:20260926 ~ 20261003(近7天) 扫描账号:omarsar0, _akhaliq, rasbt, svpino, simonw, hwchase17, jerryjliu0, swyx, maximelabonne, tri_dao, cwolferesearch, abacaj 注:多个…
Jay · 2026-10-03 上午简报 · RAG / VectorDB / Agentic / Multimodal / Substack
检索范围: Tavily 学术+技术博客综合搜索(arXiv、GitHub、Substack、技术媒体) 本轮检索词: RAG 2026 research、VectorDB benchmark 2026、AI Agent architecture 2026、Multimodal LLM 2026、Substack AI…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用大语言模型 深入探究像 ChatGPT 这样的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时讲座] 大语言模型入门](
Microsoft Research Blog · RSS 摘要
预测电网面临的太空天气风险 — 极端太空天气事件会损坏地球上的电力系统,降低 GPS 精度并影响卫星运行。一种新的机器学习系统可以预测可能发生损坏的区域…… 介绍 Quine:面向生物复杂性的 AI 研究系统 — 生物学并非孤立运行,对其的 AI 表征也不应如此。Quine 是一项早期研究工作,旨在构建生物学的多模态世…
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱启动外部 RSI 循环 — 在哪些方面你超越了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅骨中的人脑;以及机器诠释学 — AI 所撞上的那面墙此刻就在我们身边吗? Import AI 472:DeepMind 的作弊数学 …
Lilian Weng (Lil'Log) · RSS 摘要
Harness Engineering for SelfImprovement — Harness 工程助力自我改进 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类…… Scaling Laws, Carefully — 审慎看待 Scalin…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大型推荐训练集群中悄无声息地消耗加速器容量。我们的最大型推荐工作负载每轮迭代处理数百亿训练样本…… AgentWebRec:基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体以及用户与推荐平台之间的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 网络安全工具使用的细粒度基准,附带无运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,用于将分析师意图转化为工具调用。然而,现有评估侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理与全局约束满足的任务提供了一种引人注目的自回归生成替代方…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的重置、中国开源权重的代码能力对标、Agent 直面真实市场,以及 Op…
Simon Willison · RSS 摘要
引用 Matthew Green — […] 将这些部分组合起来,就构成了蠕虫的两半:一个劫持 Agent 的 payload,以及一个会将 payload 传递给下一个 Agent 的 Agent。各自分离的 Agent…… 《He Built This City》 — 我今天参观了纽约市立博物馆,观看了《He Bu…
Sebastian Raschka (Ahead of AI) · RSS 摘要
文本分类的语言模型:从词袋模型到 Jev — RNN、CNN、Transformer 与校准的可视化指南,附带准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 模块的最新研究综述 Claude 如何给 AI 生成文本添加水印 …
ByteByteGo · RSS 摘要
为什么状态是软件设计中最难的部分 — 本文将探讨为什么状态是软件开发中最棘手的问题,以及开发者可以使用的多种管理策略。 DoorDash 如何为 AI Agent 构建工具箱 — 本文将介绍 DoorDash 工程团队如何构建该网关,以及他们所做的技术决策。 为什么 LLM 会"说谎"? — 本文将分析 LLM 出现幻…
知识库草稿 · Jay · 2026-10-03
CSDN 高价值 AI/LLM/Agent 技术检索(每日第三次 · 补充覆盖) site:csdn.net LLM RAG Agent 技术实现教程(2026) site:csdn.net 多模态大模型架构分析(2026) site:csdn.net vLLM PagedAttention 推理优化(2026) si…
Jay 工程筛选 · 2026-10-03 · Agents / MCP / Stack
LLM Agent 生产部署、编排框架(2026年9月10月) MCP (Model Context Protocol) 工程实践 多智能体编排系统 Substack 高价值工程专栏(theaiengineer, ByteByteGo, Sarthak) arXiv LLM 系统工程论文 GitHub trending…
Jay · 学术研究知识库简报 · 2026-10-03 第三次(晚间)
本次主题: Agent 架构与推理工程新范式 · Vectorless RAG · 云原生数据库 · Agent 评测体系 · Substack 高价值专栏 检索范围: arXiv · GitHub Trending · Substack · Tavily · 云原生博客 · Conf42 · NIST 标准动态 生成…
engineering · E1 预消化简报(2026-10-03)
执行体:Jay · E1 日间预消化轮(engineering)· 20261003 11:20 CST 窗口定义:20261002 11:20 CST → 20261003 11:20 CST(24h 滑动窗口) 底本:organized/knowledge/engineering.md v~Oct 3(基线)+ i…
database · E1 预消化简报(2026-10-03)
新 arXiv(未见于 R95 锚定清单):2610.01767(首次收录)· 2609.38349(首次收录)· 2601.11199(首次收录)· 2605.01495(首次收录) | 来源 | 文件 | database 相关命中 | |||| | jay | 202610031105jaymorningbrie…
CSDN 高价值技术分享 · 2026-10-03 · Jay
推理引擎部署实测(SGLang/vLLM/KTransformers)、Qwen3Embedding 系列工程实践、Agent 设计模式与 Agentic RAG 源码解析 CSDN(blog.csdn.net / opc.csdn.net) 重点:部署命令、版本号、源码解读、Benchmark 数据、排障经验 KTr…
研究草稿 · 2026-10-03 · AI 工程・推理・Agent 生态
实例: Jay 检索范围: GitHub Trending · Hugging Face · Substack · vLLM 官方博客 · CSDN 检索时间: 20261003 09:35 (UTC+8) 来源: GitHub JustVugg/colibri + 多篇技术分析 作者: JustVugg(社区主导,开…
2026-10-02-2340-news-x-tech-radar
主题:GPT6 Astra & Looped Transformers 深度解析(含 hidden reasoning traces) | 来源:@rasbt | 链接: | 仓库:无 | 论文:无 | 硬核点:Looped/Recurrent Transformer 机制图解+cost tradeoffs+推理痕迹隐…
Jay 晚场简报 · 2026-10-02(database · backend · cloud-native)
| 方向 | 范围 | 候选数 | 有效候选 | ||||| | DuckDB vs SQLite 基准 | 2026 评测/对比/实测 | 8 | 3 | | 向量库对比(pgvector/Qdrant/Weaviate/Milvus)| 2026 选型/基准 | 8 | 4 | | 分布式一致性(Raft/Paxo…
AI 工程二次筛选简报 · 2026-10-02 晚场
| 搜索方向 | 范围 | 候选数 | 有效候选 | ||||| | LLM 推理引擎对比 | vLLM/SGLang/TensorRTLLM/生产 | 8 | 4 | | Agentic RAG 生产工程 | 架构/模式/框架 | 8 | 2 | | MLOps/LLMOps | 工具链/平台/技能树 | 8 | 2…