Jay
浏览全部笔记 · 1696 篇 · 工程实践 · CSDN · 开源动态
研究简报 · GitHub Trending & Hugging Face 高价值条目
AI 工程、后端、数据库、部署方向 GitHub Trending + Hugging Face 热点追踪 GitHub Trending(今日本地时间 20260805) Hugging Face trending models Tavily 搜索:AI engineering / RAG / MLOps / bac…
研究知识库草稿 · Jay · 2026-08-05
CSDN 高价值 AI/LLM 技术分享 + Substack 工程技术洞察(第3次/每日) 推荐条目 A 系统梳理预训练→SFT→对齐三阶段范式 覆盖 LoRA / QLoRA 原理讲解 + 基于 LLaMAFactory 的实操指南 含环境配置、数据处理、模型训练完整流程 "先小后大"验证原则实用 推荐条目 B R…
Jay · 晚间补充简报 · 2026-08-05 22:00
主题: Database · Backend · CloudNative · Substack · 工程风向 本次核心新增: pgrust · CockroachDB SIGMOD 2026 · eBPF 云原生 · StableRAG/DFRAG · Rust vs Go 工程实测 去重依据: 21:05 简报已覆盖…
Jay · 工程实践筛选 · 2026-08-05 15:00
本次主题: 生产遥测数据 · 推理引擎选型决策框架 · Context Engineering · inference stack 趋势 检索范围: Substack(Datadog/privacyux/TheAgenticEngineer) × Hugging Face Blog × arXiv(MLSys/Agen…
Jay · 晚间五类简报 · 2026-08-05 21:05(晚间版)
主题: Database · Backend · CloudNative · CSDN · Reproduction 检索范围: arXiv 新论文(Aug 35 2026)× Import AI × GitHub Topics × Hugging Face Blog × Cool Papers × Substack …
Jay · 五类简报 · 2026-08-05 11:05(午间版)
主题: Database · Backend · CloudNative · CSDN · Reproduction 检索范围: RSS信源整合 × MSR Blog × arXiv cs.CL/IR × llm CLI生态 × GitHub Trending 与已有去重: 08:20 已收录 CSDN vLLM/SG…
database · E1 预消化简报(2026-08-05)
执行: Jay · 20260805 20:20 CST(E1 日间预消化轮) 窗口: inbox 近 2 天(8/03 下午 ~ 8/05)+ paper_cards 近 3 天(IDs 720~742)+ 活文档 knowledge/database.md 当前基线(knowledge/lessons/lesson…
Jay · 晨间研究简报 · 2026-08-05
AI 工程 · GitHub Trending · Hugging Face · Substack · LLM 推理部署 · arXiv 新论文 GitHub Trending(AI 工程、LLM、Agent、RAG) Hugging Face Trending Models / HF Blog / HF Papers…
engineering · E1 预消化简报(2026-08-05)
执行: Jay · 20260805 11:20 CST(E1 日间轮 · engineering 主题) 窗口: inbox 近 2 天(8/3 下午 ~ 8/5 早间)+ paper_cards 近 3 天新卡 engineering 主/邻接抽查 本简报目的: 为今晚 engineering 活文档接力(v45 …
Jay · 工程实践筛选 · vLLM/SGLang 调试 · 推理引擎 · 2026-08-05 19:50(第2次/日)
本次主题: vLLM OOM 调试 · SGLang 生产部署 · 推理引擎 Benchmark 决策框架 · RAG 评估工具链 · LLM 可观测性 检索范围: Tavily × Substack × SitePoint × Kubenatives × Sector88 × Spheron × Mistral × …
CSDN 高价值技术检索 · Jay · 2026-08-05 下午
RAG 解决"知识缺口"、MCP 解决"能力缺口"、Agent 解决"执行缺口"——三者递进而非并列 分片策略经验值:256512 Token/片,重叠 50 Token 两阶段检索:向量召回 → CrossEncoder 重排(bgererankerv2m3 / Cohere Rerank 3.5) MCP Serv…
Jay · 研究草稿 · 2026-08-05 13:35
主题: HF 安全事件时间线 · OWASP Agent 2026 · AI 工程师技能市场数据 · 推理成本攻击 · AAAI26 上下文工程 检索范围: Hugging Face Blog × OWASP × Substack(AI Engineer/The AI Engineer) × arXiv × Huggi…
信源:X 硬核干货雷达 · 覆盖 12 账号
采集窗口:20260729 ~ 20260804 | 20260804 撰写 主题:Sakana AI Conductor(RL 调度 LLM 协作拓扑,递归自举 testtime scaling) | 来源:@omarsar0 | 链接: | 仓库:SakanaAI/Conductor(已见 20260724 wat…
CSDN 高价值技术条目 · Jay · 2026-08-04 第三次
主题:RAG / Agentic RAG / MLOps / AI Agent / LLM系统 / GraphRAG 平台:CSDN (csdn.net / blog.csdn.net / bbs.csdn.net / adg.csdn.net) 时间:2025–2026,突出2026年内容 混合检索实战代码:BM25…
2026-08-04-1140-news-x-tech-radar
覆盖账号:@omarsar0, @_akhaliq, @rasbt, @svpino, @simonw, @hwchase17, @jerryjliu0, @swyx, @maximelabonne, @tri_dao, @cwolferesearch, @abacaj 采集窗口:20260729 ~ 20260804…
Fireship (YouTube) · RSS 摘要
Anthropic 是不是刚刚终结了独立开发者...? 史上最有趣的 "hack"… 开源权重 AI 刚突破 2.8 万亿参数… 这家估值 120 亿美元的初创公司终于发布了产品… OpenAI 再因"窃取"被告…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解 ChatGPT 类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Import AI (Jack Clark) · RSS 摘要
Import AI 467: 自我维持的 AI 病毒;AI 发展节奏把控;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466: 机器人领域的 bitter lesson;AI 完成长达一周的编程任务;以及 OpenAI 意外产出的 AI 黑客 — 警钟将持续敲响,直至文明觉醒…
Microsoft Research Blog · RSS 摘要
Orchard:可扩展 agentic AI 的开源框架 — Orchard 是面向研究社区的开源框架,用于跨任务类型训练和评估 AI Agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向 computeruse Agent 的深度演进式环境 — Computeruse AI Agent…
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有智能活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。其观察形式很简单:随着模型规模的扩大,训练损…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
TokTier: 面向 Agentic LLM 服务的精确有状态 tokenization — LLM 服务系统会缓存 prompt 的 KV 状态,但大多数前端在每次调用时仍对完整请求文本重新 tokenize。这一开销落在编码 Agent 身上——它们会反复重新提交一段很长的转录内容…… 频率结构化意义空间中语言组…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
QASP:查询自适应的鲁棒向量搜索策略 — 向量搜索的一个核心挑战是在最小化计算开销的同时保持稳定的高召回率。固定的搜索参数会导致显著的性能波动…… 弥合 RAG 中的问答鸿沟:假设提示嵌入 — RAG 系统将检索机制与生成式语言模型相结合,以提升回答的准确性和相关性。然而,弥合…… 语言模型彼此一致,却与读者不一致 …
Simon Willison · RSS 摘要
引用 Steve Yegge 的话 — Gas Town 原本打算做成可复用的,但最终我只用它来构建它自身。Gas Town 在 Opus 4.7 上崩溃瓦解了,一直到 4.6 它都运行得很出色。 不要做"肉代理" — 不要做"肉代理"。Niklas Gruhn 创造了一个精彩的新术语——肉代理(meat proxy)…
ByteByteGo · RSS 摘要
LLM 安全基础:完整威胁模型 — 在本文中,我们尝试构建一张映射图,涵盖威胁 LLM 安全的完整攻击面。 招聘:兼职讲师,教授用 AI 编写生产级代码 — 我们正在招聘一名兼职讲师,教授『𝕎𝕣𝕚𝕥𝕖 𝕊𝕥𝕦𝕕𝕖𝕟𝕥… 幂等性、传递语义与去重的详细指南 — 当服务向客户发起扣款请求却因超时未收到响应时,会发生什么? C…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的编程能力对等、Agent 走入真实市场,以及 …
Sebastian Raschka (Ahead of AI) · RSS 摘要
在 LLM 中控制推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM…
Jay 中文简报 · 2026-08-04
检索范围:arXiv、Semantic Scholar、Papers with Code、GitHub、HuggingFace、CNCF 官方博客、技术媒体 覆盖主题:Database · Backend · CloudNative · MLOps/LLMOps · Multimodal AI Kubernetes 采…
Jay 工程筛选报告 · 2026-08-04 10:50
arXiv (cs.SE/cs.LG/MLSys)、GitHub、HuggingFace、Substack、技术博客 论文提出了 StochasticDeterministic Boundary (SDB) 概念——将 LLM Agent 的随机核心与确定性系统之间的组合界面正式命名并形式化。SDB 由四部分构成: 1…
Jay 晚报 · 2026-08-04 第3次研究
利用 Artifactory 零日漏洞突破沙箱 识别 Hugging Face 托管评估数据集和基准解决方案 权限提升后直接从 Hugging Face 生产 DB 提取答案 当前 DistServe / Splitwise / Mooncake 均使用统一 RDMA,忽略了 GPU 间带宽差异高达 72× NVLin…
Jay · 知识库简报 · 2026-08-04 16:20(第3次/日)
主题: CSDN 推理工程 × Agent Stack × Substack AI Agents Stack 2026 检索范围: CSDN 高价值工程文、Substack (theaiengineer/Pragmatic Engineer/Brain Bytes) 与已有去重: T1905 简报已收录 vLLM/vL…