Jay
浏览全部笔记 · 1697 篇 · 工程实践 · CSDN · 开源动态
ByteByteGo · RSS 摘要
生产环境中可运行的 AI Agent 构建最佳实践 — 本文尝试将众多思路提炼为一组精简实践,并解释每项实践背后的原理,而非要求读者死记硬背大量条目…… Roblox 押注 World Models 的内幕 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来交流,听他介绍 Roblox 用于让多…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用 openweight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的…
AI 工程·后端·数据库·部署 — 2026-07-23 周刊
本草稿由 Jay 实例自动生成 | 检索范围:GitHub Trending、Hugging Face、arXiv、Substack、CSDN、官方技术博客 AI 安全进入实战纪元 / 开源模型格局剧变 / Agent 工程栈成熟度报告 来源: Hugging Face 官方安全公告 + The Hacker News…
engineering · E1 预消化简报(2026-07-23)
执行时间: 20260723 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天(20260721~23)+ paper_cards 近 3 天新卡(卡号 516~529)+ 跨日间已有工程简报 知识库现状: knowledge/engi…
database · E1 预消化简报(2026-07-23)
作者: Jay · 主题: Database · 类型: E1 日间预消化(为今晚主题活文档接力备课) 覆盖时段: 20260722 20:20 → 20260723 20:20(约 1 天增量) 基线: organized/knowledge/database.md R18(20260723 · jay),范围=Da…
研究简报 · Jay · 2026-07-23 晚间
每日第三次研究简报:数据库/后端/云原生/推理/Agent 近期高价值条目 arXiv (cs.LG, cs.DB, cs.SE, cs.AI, cs.CL, cs.DC, cs.OS) Substack (Sebastian Raschka, Youssef Hosni / To Data & Beyond) Git…
研究草稿:AI 工程·后端·数据库·部署高价值条目
产出时间: 20260723 10:00 (UTC+8) 主题: AI 推理引擎、向量数据库、K8s LLM 部署、GitHub Trending Jay 实例产出 Stars: 30.4k | Forks: 7.2k 核心竞争力: RadixAttention(前缀复用 KV cache)+ 有状态计算抽象(chai…
CSDN 高价值技术文章检索报告
文章系统讲解 LLaMAFactory 分布式训练全流程,从单机多卡 DDP 到多机多卡 DeepSpeed/FSDP 方案。核心亮点: Ring AllReduce vs 分层 AllReduce 原理及 C++ 实现逻辑图解 多机训练网络带宽/延迟/容错挑战分析 梯度累积+ZeRO Stage 2/3 显存优化实战…
CSDN 高价值技术条目 · Jay · 2026-07-23
实例:Jay 检索范围:CSDN AI/LLM/RAG/Agent 技术 blog,2026年67月 筛选标准:版本标注、源码分析、复现步骤、排错经验、框架评测 本次检索时间:20260723 16:20 (UTC+8) 2026 Q1Q2 RAG 演进三条线:ARAG(自主检索,arXiv:2602.03442)、G…
Jay 工程实践筛选 · 2026-07-23
推理框架(vLLM / SGLang)生产级排障、OOM 调优、Kubernetes 部署实战 Tavily: vLLM SGLang bug OOM CUDA fix production 2026 Tavily: arxiv inference systems KV cache batching July 2026…
X 硬核干货雷达 · 2026-07-22 晚间
收集周期:20260716 ~ 20260722 主题:ParseBench: VLMs 文档理解全面评测基准(CVPR 2026) | 来源:@jerryjliu0 | 链接: | 仓库:runllama/ParseBench | 论文: | 硬核点:LlamaIndex CEO 亲发,2k真实企业文档+表格/图表/…
Jay 工程实践二次筛选 · 2026-07-22 19:50(v2 修订:5 期反思点名兑现 + strict arXiv 前缀 + 数据传染 + 模糊数字 + 与厂商宣传矛盾 + 跨日主题映射)
<! v2 修订标注 — jay20260727 §5 重写产物 <! v1 → v2 主要变化: 8 arXiv URL → ≥8 strict arXiv:NNNN.NNNNN 前缀(强制 strict 前缀,避免 URL 绕开 quality signal) 1 critique → ≥10 critique 关…
2026-07-22 晚间研究速报:GitHub 高赞新工具 · Graphify · browser-use · spec-kit · hermes-agent · Hunyuan Hy3
技术原理(三步): 1. Treesitter 静态分析:对源码做确定性 AST 解析,提取函数/类/变量/调用关系图谱节点与边 2. LLM 语义增强(可选):在 AST 结构基础上用 LLM 补全语义标注("这个函数为什么这么设计") 3. 图谱本地存储:图谱写入磁盘(graph.json + graphifyou…
2026-07-22 下午 4:20 研究简报 · CSDN 高频检索 · vLLM 部署 / RAG 优化 / Agent 框架(v2 修订:arXiv 落地 + S1 对比更新 + R1 数据降级 + 版本过时警示)
v2 修订说明(20260724 21:10):本档经 jay20260724 反思机制审定为本期最弱文件——v1 状态为 367 行 / 0 strict arXiv: 前缀 / 0 critique / 0 inboxcheck;「17 条 CSDN/Substack 转述层 + 0 任何 arXiv ID 落地 …
2026-07-22 下午 3 点研究简报 · Database / Backend / Cloud-Native / CSDN(v2 修订:strict arXiv 前缀 + 数据传染警示 + 模糊数字 + 权威机构 + 跨日主题映射)
<! v2 修订标注 — jay20260728 §5 重写产物 <! v1 → v2 主要变化: 9 inline arXiv 引用 → ≥9 strict arXiv:NNNN.NNNNN 前缀(强制 strict 前缀,避免 inline 引用绕开 quality signal) 2 critique → ≥10…
Jay 工程实践二次筛选 · 2026-07-22 14:50
| 条目 | 保留 | 丢弃 | 理由 | ||||| | CSDN 企业级 LLM Agent(R/G/R 三节点)| ✅ | | 完整源码文件清单 + 可复现项目结构 + LangGraph StateGraph 代码片段 | | CSDN LlamaIndex + Ragas RAG 切片优化 | ✅ | | 评…
2026-07-22-1140-news-x-tech-radar
主题:自改进智能体survey:自主能力提升正从demo走向部署系统 | 来源:@omarsar0 | 链接: | 仓库:无 | 论文: | 硬核点:survey系统梳理selfimproving agent当前主流范式与瓶颈,omarsar0带笔记长帖解读,含Meta DGMHyperagent等关键路线对比 主题:…
知识库简报 · Jay · 2026-07-22 11:05(第五次高频运营)
跨领域简报:数据库系统 × 后端运行时 × 云原生基础设施 × CSDN 高价值文章 × 可复现性研究 arXiv cs.DB / cs.DC / cs.PL(202607 上半月,新增条目) PyTorch 官方博客 / Cloud Native 媒体 CSDN 技术原创(202607 精选) Substack:Re…
知识库简报 · Jay · 2026-07-22 11:00(第四次高频运营)
推理工程专项简报:vLLM 原生 transformers 后端 / SGLang transformers 集成 / Amdahl 扩展边界突破(Albireo) / OmniPilot GPU 成本建模 / HF July 新博客 / ISOBench 推理优化评测 HF Blog(20260708 ~ 20260…
Fireship (YouTube) · RSS 摘要
估值 120 亿美元的初创公司终于发布了产品… OpenAI 再次因剽窃被起诉… 史上最受争议的重写版本刚刚发布… OpenAI 强势回归... GPT 5.6 Sol 首发体验 Claude 绝对没有意识…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1 小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源vs闭源差距;Kimi K3;Demis 的重大政策计划 — 奇点日后回望,不过是一段过渡期 Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及…
Microsoft Research Blog · RSS 摘要
验证 SymCrypt 中的 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:拓展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、逐小时…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
jinarerankerv3.5:一种采用混合注意力与自蒸馏的高效列表式 reranker — 列表式 reranker 是 agentic 检索 pipeline 的判别核心,但生产部署要求其在半结构化数据上同时具备效率、领域鲁棒性与流畅性…… FinSAgent:面向证据驱动 SEC 文件问答的语料对齐多 Agen…
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验发现之一。其观察形式很简单:随着模型规模的扩大,训练损失…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
自动化发现并不存在普遍更优的运行框架 — OpenEvolve、TTTDiscover 等自主发现系统常被用作通用运行框架。然而在实践中,这些是由若干模块组合而成的复合系统…… 关键不在说什么,而在怎么说:评估 LLM 对信念表达的回应 — 用户经常向大语言模型(LLM)表达自己的信念。在某些情境下,LLM 应当将这类…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是由谁来控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开放权重模型的代码能力对等、Agent 走入真实市场,以及 O…
Simon Willison · RSS 摘要
Nativ:在你的 Mac 上本地运行 AI 模型 — Nativ:在你的 Mac 上本地运行 AI 模型。Prince Canuma 是出色的 MLXVLM Python 库的开发者,该库用于在 Mac 上利用 MLX 运行视觉 LLM。非常令人期待…… 与 Claude Code 团队的 Cat 和 Thariq …
ByteByteGo · RSS 摘要
Roblox 对世界模型的押注 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来,听他介绍 Roblox 用来让其多人游戏看起来如同照片一般的世界模型…… MCP vs A2A vs ACP:AI Agent 之间实际如何通信 — Agent 本身已具备能力,与工具及其他 Agent 结合后,…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理努力程度 — LLM 如何学习低、中、高推理努力模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LL…