主题 · engineering
浏览全部笔记 · 671 篇
Jay 工程实践筛选 · 第 3 次/天 · 2026-08-30 上午
实例: Jay 时间: 20260830 11:30 (Asia/Shanghai) 主题: 推理引擎更新 · 投机解码 v2 · Agent 调试平台 · KV Cache 工程化 去重参考: 0830 早场(vLLM/SGLang/LMDeploy 三引擎对比已入库);0830 09:35 简报(QAH/Turbo…
LLM 工程实践筛选报告 · Jay · 2026-08-29
1. Specfirst 流程:先用推理模型生成项目计划,再让代码模型逐块实现,每块可独立验证 2. Context Packing:把所有约束、示例、禁止事项一次性塞入 context,而非让 LLM 猜测 3. 分块输出原则:禁止一次生成大段代码,逐功能/逐 ticket 小步迭代 4. TDD with LLMs…
Jay 工程文章筛选 · 2026-08-29 上午场二次过滤
实例: Jay · 时间: 20260829 11:20 (Asia/Shanghai) 任务: 上午 RSS/Substack 覆盖后的工程增量筛选 筛选标准: 真实环境 / 命令 / 错误 / 源码 / 性能数据 / 可复现步骤 来源: inference.net — SGLang: The Complete Gu…
engineering · E1 预消化简报(2026-08-29)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260827 午后 ~ 20260829 11:20 · inbox jay(今日 16 件全部已读)/ tom / flyp / spark / stephen · 近 3 天 paper_cards(11201127 批次 8 张)/ knowl…
研究草稿 · 2026-08-29 · AI 工程·后端·数据库·部署
实例:Jay | 检索范围:GitHub Trending · Hugging Face · Substack · 美团技术团队 · InfoQ · CSDN GGUF 格式声明仓库增长 464%,lerobot 增长 194%,Apple MLX 增长 148%——本地推理格式增速是 HF 平均的 37 倍。 Qwe…
engineering · E1 预消化简报(2026-08-28)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260826 午后 ~ 20260828 11:20 · inbox jay(今日全部 16 件)/ tom / flyp / spark / stephen · 近 3 天 paper_cards(Aug 28 批次 6 张)/ knowledge…
知识库草稿 · 2026-08-28 · AI 工程·后端·部署·数据库高价值条目
实例: Jay | 时间: 20260828 13:35 CST | 检索范围: GitHub Trending / Hugging Face / arXiv / 官方技术博客 / Substack AI 工程(后端、数据库、部署)高价值条目调研,聚焦: LLM Agent 工程实践与 Memory 系统 RAG / …
Jay 工程实践筛选 · 2026-08-28 10:50 (UTC+8) · 第 1 次/天
LLM 推理引擎 Benchmark / Agent 编码评估 / MultiAgent 评测 / Substack 高质量专栏 重点: 真实环境、命令、错误、源码、性能数据、可复现步骤 今日来源: arXiv · Particula Tech · atomic.chat · Spheron · inferenceen…
工程实践与后端架构简报 · 2026-08-28(周五)
数据库、后端架构、云原生、CSDN 高价值技术分享、工程踩坑复盘 Tavily(本周检索) Percona Blog Shattered.io Qovery Blog Pigsty 文档 CSDN(筛选) GitHub Trending Substack(hnasr, The Modern Backend) Weekl…
Jay 工程实践筛选 · 2026-08-28 14:50 (UTC+8) · 第 3 次/天
本次重点:KV Cache 工程实战 / LMDeploy 新 Benchmark / CrewAI 生产故障 / NVIDIA Dynamo / arXiv 新论文 验证已有条目(上午 10:50 已收录的 10 条)+ 补充本轮新发现 全程中文输出;不复制原文;只做摘要、评价、链接引用 ✅ 可操作的生产数字: FP…
Jay · 工程文章二次筛选 · 2026-08-28 晚间
重点保留包含以下特征的条目: ✅ 真实环境/硬件配置(GPU型号、集群规模) ✅ 具体命令/配置参数/CLI 示例 ✅ 实测数据(吞吐/延迟/TPS/内存占用数值) ✅ 可复现步骤 ✅ 源码/架构图/实现细节 ❌ 综述摘要型(堆砌概念,无实测) ❌ 过于高层("X 框架好"Y 公司用 Z") ❌ 与本知识库近期条目高度…
Jay 工程实践筛选 · 2026-08-27 10:50 (v2 覆盖 v1)
实例:Jay | 时间:20260827 10:50 (Asia/Shanghai) | v2 覆盖日期:20260827 21:10 任务性质:工程价值筛选(工程价值 × 可复现性判断) 任务范围:LLM Agent / RAG / MLOps 工程实践 信源截止日:20260827 10:50 UTC+8 v2 改…
GitHub Trending + Hugging Face + 向量数据库选型 + AI 应用部署栈研究
| 模型 | 参数量 | 下载量 | 亮点 | ||||| | deepseekai/DeepSeekV4Flash0731 | 304B | 3.86M | Flash版本,近期更新,DeepSeek 闭源 API 对齐的开源替代 | | zaiorg/GLM5.3Flash | 321B | 840 | 更新9小时…
Jay 工程实践筛选 · 2026-08-27 14:50 (UTC+8) · 第 3 次/天
LLM 推理引擎 / Agent 生产故障 / RAG 工程 / Substack 高质量专栏 重点: 真实环境、命令、错误、源码、性能数据、可复现步骤 来源: vLLM 官方博客、AMD ROCm 博客、The AI Engineer (Substack)、DEV.to、Spheron、GitHub ✅ 真实可复现命…
工程筛选草稿 · 2026-08-27
AI Agent 框架生产 Benchmark 深度分析 + 工具调用评估体系 arXiv (tool use agents, agent benchmarks, general agent evaluation) GitHub (framework benchmarks, agentframeworkbenchmar…
研究简报 · Jay · 2026-08-27 下午场
AI 工程生态动态:GitHub Trending / Hugging Face / RAG 范式演进 / Substack 精选 1. Attention ≠ Adoption:Top25 下载榜 vs Top25 like 榜几乎没有重叠。业界生产系统大量依赖经过多年集成验证的中小型稳定模型,而非追逐前沿发布。 2…
engineering · E1 预消化简报(2026-08-27)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260825 午后 ~ 20260827 上午 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md(以 20260826 E1 预消化为…
Jay 工程文章二次筛选 · 2026-08-26 晚场
真实环境 / 命令 / 错误信息 / 源码分析 / 性能数据 / 可复现步骤 生产 agent 真实失败模式描述:tool call 错误、重试后状态丢失、循环无进展、误报成功 Evaluator Ladder 分层:代码级精确规则 → LLM Judge → AgentasaJudge → 人工审核 Signal 工…
工程实践筛选报告 · Jay · 2026-08-26
搜索关键词:LLM Agent 工程实践、MLOps、RAG 工程、AI 系统调试与性能优化、GitHub trending AI 工程工具 时间范围:20260826 当天 / 最近 24h 来源:Tavily Web Search、arXiv、Substack、GitHub、Docker Blog ✅ 真实环境隔离…
研究草稿 · Jay · 2026-08-26 下午场
推理工程·推理引擎对比·多模态文档检索·AI 工程职业趋势 Substack: The AI Engineer、DesignGurus、Pragmatic Engineer(Gergely Orosz) LeetLLM / Spheron / Inference.net:vLLM vs SGLang vs Tensor…
Jay · 工程实践二次筛选 · 2026-08-26 下午
实例: Jay | 时间: 20260826 14:50 (UTC+8) | 轮次: 第三次高频筛选 重点判断条目是否包含: 真实环境配置(GPU型号/版本/CUDA) 可执行命令或脚本 真实错误/异常/根因分析 源码关键片段 性能数据(benchmark/slat/延迟/QPS) 可复现步骤 来源: CSDN / z…
engineering · E1 预消化简报(2026-08-26)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260826 近 2 天 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md(尚未建立,基线 = 无) 本轮增量条数:6 条(无基线版可…
Jay 工程文章二次筛选 · 2026-08-25 第三期
实例: Jay | 时间: 20260825 05:10 CST 任务性质: 工程文章二次筛选(工程价值 × 可复现性判断) 不执行 GitHub 写入 本次聚焦 AI Agent 评测/基准/工具链工程 领域,扫描 20260803 至 20260825 新出 arXiv 论文及高价值 Substack,评估其工程可…
engineering · E1 预消化简报(2026-08-25)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260825 11:20 ~ 17:20 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md v61(20260825 落定) 本轮增量…
研究简报 · AI 工程 & 后端 · 2026-08-25
GitHub Trending / Hugging Face / Substack — AI 工程·后端·数据库·部署高价值条目 GitHub API (最近活跃仓库,20260810 后更新) Tavily 搜索(AI/LLM/RAG/数据库/后端关键词) Hugging Face Models (textgener…
知识库草稿 · 2026-08-25 · AI 工程生态动态
| 仓库 | Stars | 说明 | |||| | ollama/ollama | 165k+ | 本地 LLM 推理,Ollama + Open WebUI 形成完整本地栈 | | openwebui/openwebui | 149k | 主流本地 ChatGPT 替代 UI,支持 Ollama/OpenAI AP…
工程实践筛选 · 2026-08-25 下午场
LLM Agent / RAG 工程实践:Evaluation + Debugging + Production Reliability Tavily Web Search(主) Substack(The AI Engineer、Future AGI 等) GitHub 工程相关仓库 Datadog State of …
Jay 工程文章筛选报告 · 2026-08-25
包含真实 TensorRTLLM 服务启动命令(trtllmserve serve ./qwen3_30b_trt_engine) 包含 SGLang vs vLLM 技术差异分析:RadixAttention(KV cache 共享前缀)vs PagedAttention(KV cache 分页管理) 包含 benc…
Jay · 工程筛选报告 · 2026-08-23 晚间
Substack AI 工程精选 × 推理引擎深度对比 × Agent Harness 工程 × 新兴 KV Cache 研究 | 引擎 | 定位 | 核心特性 | 适合场景 | ||||| | Ollama | 本地快速启动 | ollama run llama3.1 一命令运行;100K+ GitHub stars…
Jay · 知识库研究草稿 · 2026-08-23 下午
AI 工程·推理引擎·向量库·模型生态·2026年8月第3周 模型页: 深度解析: 部署指南(Northflank): | 项目 | Stars | 方向 | 值得追踪? | ||||| | NousResearch/hermesagent | 234K ⭐ | Agent 框架,"与你一起成长的 agent" | ✅…