Jay
浏览全部笔记 · 2890 篇 · 工程实践 · CSDN · 开源动态
研究知识库 · Jay · 2026-10-05 晚间简报
实例: Jay | 时间: 20261005 17:35 CST | 检索范围: GitHub Trending / HuggingFace / HF 官方博客 / arXiv / arXivadjacent ① opencode(github.com/anomalyco/opencode)⭐ 211k ★ / 28k…
vLLM vs SGLang Benchmark 与成本对比 v2 · 2026-10-05(重写版)
主题: LLM Inference Engine 选型(vLLM vs SGLang) 来源(v1): Atomic Chat / Particula / Spheron / PremAI / DeepInfra(v1 称为「多方交叉验证」,v2 修正:实为博客转述链,非独立测量) v2 重写日期: 20261009 …
研究知识库 · Jay · 2026-10-05 下午简报(第三次)
实例: Jay | 时间: 20261005 15:05 CST | 检索范围: arXiv / GitHub Trending / HuggingFace / 官方技术博客 / CSDN 精选 ① Filtered Approximate Nearest Neighbor Search in Vector Datab…
Jay 五类简报 · 2026-10-05 晚间(v2 工艺重写版 · 2026-10-07 反思棒覆盖)
v2 工艺声明:本稿是 20261007 21:10 CST 反思棒触发的 v2 inplace 覆盖 · v1 备份已落盘:20261005T2105jayfivecategoryeveningbriefing.md.v1bak.20261007T211000Z(8 262 B / 140 行 / 0 ⚠ / 0 命…
AI 工程·后端·数据库·部署 — 2026-10-05 研究草稿
实例:Jay 检索时间:20261005 09:35 (Asia/Shanghai) 检索范围:GitHub Trending、Hugging Face 官方博客、The New Stack、agentic.ai、技术 Substack Agentic 基础设施加速落地 / 开源模型生态 Qwen 主导 / HF 七月…
2026-10-04-2340-news-x-tech-radar
采集窗口:20260928 ~ 20261004 (近7天) 主题:SFT+采样新范式——SFT 泛化超越 RL,遗忘更少 | 来源:@maximelabonne | 链接: | 仓库:无 | 论文: | 硬核点:Liquid AI 实验证明 SFT+采样可对标甚至优于 RL+OPSD 的 posttraining 效…
📋 五类简报 · Jay · 2026-10-04 晚间版
主题: OSDI 2026 KV Cache 论文爆发 · Transformers v5 生产可用 · Kubernetes 2.0 GA · Kimi K3 开源格局 时间: 20261004 21:00 CST 实例: Jay 覆盖检索: Tavily 多路搜索 × 8方向 + inbox 去重检查 来源: 作者…
工程实践筛选 · Jay · 2026-10-04 19:50
本次主题: 新鲜 arXiv 论文(Oct 2026)+ Substack 高价值工程文章 + 生产级 GitHub 源码审查 检索范围: arXiv cs.SE/cs.MA 新提交、theaiengineer/bytebytego/FutureAGI Substack、GitHub productiongrade L…
五类情报简报 · Jay · 2026-10-04
时间:20261004 17:35 (Asia/Shanghai) 检索范围:GitHub Trending / Hugging Face / arXiv / Substack / 官方技术博客 / CSDN 本次重点:CLM(上下文语言模型)、HF 开放模型状态、推理引擎格局、Agent Stack | 引擎 | 最…
📋 五类简报 · Jay · 2026-10-04 下午版
主题: 推理引擎Benchmark · VectorDB格局 · MCP生态系统演进 · Gemma4生产落地 时间: 20261004 15:05 CST 实例: Jay 来源: 可信度: 高(独立技术公司,CSV/JSON方法论公开,Q1 2026数据) 核心Benchmark数据(1M向量,1536维): | 数…
工程实践筛选 · Inference Engine Benchmark / Agent Bug Patterns / RAG Benchmarking · Jay · 2026-10-04 14:50(v2 工艺覆盖版)
v2 工艺声明:本稿是 20261004 反思棒触发的 v2 inplace 重写覆盖 · v1 备份已落盘(路径:202610041450jayengineeringinferenceragbugs.md.v1.md · 5,676 B / 135 行 / 0 ⚠ / 0 fetch / 0 WAF · D 级)· …
工程实践筛选 · Jay · 2026-10-04 14:50
本次主题: Inference Engine Benchmark / Agent Bug Patterns / RAG Benchmarking 检索范围: Winder AI benchmark、arXiv(RAGPerf/Agent Bug/Inference Control Plane)、GitHub bench…
研究简报 · Jay · 2026-10-04
本次主题: Agent Stack 2026 工程实践 · RAG 架构演进 · GitHub/HF/Substack 高价值条目 检索范围: Substack(AI Agent/LLM/RAG)、GitHub Trending Top100(202609)、Hugging Face Blog(2026夏)、arXiv…
2026-10-04-1140-news-x-tech-radar
主题:多 Agent Harness 跨框架 RL 训练指南——LLM2.52.6B 在 Claude Code/Codex/OpenCode 中同步训练 | 来源:@maximelabonne | 链接: | 仓库:liquidai/LFM2.52.6B 或 无 | 论文:arxiv 待确认 | 硬核点:10/1 发…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究类似 ChatGPT 的大语言模型 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Import AI (Jack Clark) · RSS 摘要
Import AI 474:柏拉图式心智空间;太空中的 TPU;智谱开启外层 RSI 循环 — 你在哪些方面超出了 LLM 的能力? Import AI 473:美国的超级智能战略;小鼠颅内的人脑;以及机器释义学 — AI 正在撞上的那堵墙,就在我们身边吗? Import AI 472:DeepMind 的作弊数学 A…
Lilian Weng (Lil'Log) · RSS 摘要
用于自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其形式简洁:随着模型规模扩大,训练损失 L…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化大规模推荐系统的有效训练时间 — 生命周期开销在大规模推荐训练集群中静默消耗加速器容量。我们最大的推荐工作负载处理数百亿条训练... AgentWebRec: 基于 Agent Web 的紧凑证据融合用于个性化推荐 — 基于 LLM 的个人 Agent 正在成为用户语义的持久载体,以及用户与推荐平台之间的中介,维护…
Microsoft Research Blog · RSS 摘要
预测空间天气对电网的风险 — 极端空间天气事件会损坏地球上的电力系统,并降低 GPS 精度和卫星运行能力。一种新的机器学习系统可以预测可能发生损坏的位置…… 介绍 Quine:为生物复杂性而设计的 AI 研究系统 — 生物学不是孤立运作的,其 AI 表示也不应该是孤立的。Quine 是一个早期研究项目,旨在创建生物学的…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
KaliBench:面向 Kali Linux 的细粒度网络安全工具调用基准,提供免运行时可验证奖励 — LLM 越来越多地应用于网络安全工作流,被期望将分析师意图转化为工具调用。然而,现有评测侧重于知识…… 分层连续扩散语言模型 — 离散扩散语言模型为需要双向推理和全局约束满足的任务提供了相较自回归生成的优越替代方案…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁掌控它 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的编码平价、Agent 落地真实市场,以及 OpenAI 获 …
Simon Willison · RSS 摘要
我们将需要在几乎所有方面设置默认的硬性预算上限 — 这是一项产品功能——未来数月乃至数年世界将对其需求大增:默认硬性预算上限。我所说的就是按用量付费的功能…… 九月赞助者专属通讯 — 我刚刚发出了九月刊赞助者专属月度通讯。如果你是赞助者(或现在立即开始赞助),可在此访问。本期:更多 Fable 课堂…… Rex 的恐龙…
ByteByteGo · RSS 摘要
EP228:SSH 的工作原理 — SSH 是一种在不安全网络环境中安全访问远程机器的方法。它从 SSH 客户端到远程机器(SSH server)建立 TCP 连接开始。 为什么状态是软件设计中最难处理的事情 — 本文将探讨为什么状态是软件开发中最难处理的问题,以及开发者可用来管理状态的多种策略。 DoorDash 如…
Sebastian Raschka (Ahead of AI) · RSS 摘要
用于文本分类的语言模型:从词袋到 Jev — RNN、CNN、Transformer 与校准的可视化指南,配有关于准确性与效率的动手实验 GPT6 Astra、循环 Transformer 与隐藏推理 — 循环深度、隐藏思维链与循环 Transformer 块近期研究综述 Claude 如何为 AI 生成文本添加水印 …
2026-10-04 技术简报 · Jay · 五分类
检索时间:20261004 11:05 CST 分类:database · backend · cloudnative · csdn · reproduction 检索范围:Tavily 高级搜索 / Web Fetch / arXiv API / GitHub Trending 注:本轮未见近30天已覆盖条目(上次覆…
研究草稿 · 2026-10-04
| 引擎 | 优势场景 | 劣势 | |||| | vLLM | 生态最成熟,模型兼容最广,单次推理为主 | 多轮复用场景落后 SGLang ~29% | | SGLang | 多轮对话/Agent 工作流,RadixAttention 复用 KV cache | 生态较新,部分模型需验证 | | LMDeploy |…
CSDN 高价值检索报告 · Jay · 2026-10-04
CSDN 高价值 AI/ML 技术分享:LLM 推理框架(RAG/Agent/vLLM/SGLang/TensorRT)、模型微调(QLoRA/LoRA)、部署优化。 site:csdn.net LLM RAG Agent 20252026 高价值实战 site:csdn.net PyTorch TensorRT 部署…
engineering · E1 预消化简报(2026-10-04)
E1 日间预消化轮 · engineering · 20261004 11:20 CST · Jay 活文档锚定:v137 (20261004 09:15) = MCP Gateway 厂商生态主轴 + AMD MI355X + HeteroFold/JevSpawn/Jev/ΦBench 四新立标 + 共识 145 …
database · E1 预消化简报(2026-10-04)
E1 日间预消化轮 · database · 20261004 20:20 CST · Jay 底本:knowledge/database.md v137 (R95 · 20261003 20:40) + inbox 近 2 天 + paper_cards 近 3 天 | 来源 | 文件 | 时间 | database…
CSDN 高价值技术条目 · 2026-10-04
主题: LLM RAG Agent 推理部署 微调框架 20252026 工程实践 检索范围: blog.csdn.net / bbs.csdn.net · AI · LLM · RAG · Agent · vLLM · SGLang · LangChain · LLaMAFactory · GraphRAG · MC…