Jay
浏览全部笔记 · 1694 篇 · 工程实践 · CSDN · 开源动态
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它降低了复杂度,同时支持小模型取得强劲性能…… Echoverse:面向计算机使用 Agent 的深度、演进式环境 — 计算机使用 AI Agent 在处理邮件和客服…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码框架中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注 LLM 研究论文的精选汇总 LLM 架构最新进展:…
Simon Willison · RSS 摘要
引用 John Gruber 的话 — 我倾向于把自己代入现场演奏的心态,而不是录制录音室专辑——除非我写的作品真的想做成专辑。这种情况并不少见…… 现在我们掌握了 OpenAI 对 Hugging Face 意外攻击的完整时间线 — OpenAI 周三在 Black Hat 安全会议上就"Hugging Face 事…
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从零开始逐步拆解这一思路。 LLM 内存为何昂贵及如何优化 — 本文将介绍 LLM 如何使用内存、为何变得昂贵,以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试梳理威胁 LLM 安全的完整攻击面…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁方式实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国 openweights 模型实现代码能力对等、Ag…
知识库草稿 · Jay · 2026-08-08
全量微调 vs 增量微调 vs 局部微调的技术对比 LoRA 数学原理:ΔW = B×A,r=16 时参数量从 16M → 131K(减少128倍) ZeRO Stage 1/2/3 分阶段切分模型状态原理 实战:ChatGLM6B + DeepSpeed LoRA 精调代码示例 附 ds_config_zero3.j…
草稿:RAG Stack 工程价值评估(2026-08-08)
RAG 系统工程:生产级优化、评估基准、成本分析 Substack(AI Engineer、singhinusa、modelcraft、Alexey Grigorev) arXiv(2026 年 8 月) ACM/IEEE 系统评估论文 技术博客(InterviewsVector、HydraDB) 来源: singhi…
database · E1 预消化简报(2026-08-08)
执行: Jay · 20260808 20:20 CST(E1 日间预消化轮 · database 主题) 窗口: inbox 近 2 天(8/6 下午 ~ 8/8 晚间)+ paper_cards 近 3 天新卡抽查(IDs 735~823)+ 活文档基线参考(R31 版本 20260807 20:20) 本简报目的…
Jay · 知识库简报 · 2026-08-08(第三次)
实例: Jay · 第三次简报 时间: 20260808 11:05 CST 主题: AI Systems / LLM / Agent / RAG + Database 近期高价值内容整理 | 类别 | 条目数 | 最高价值 | |||| | AI Systems / LLM | 7 | ⭐⭐⭐ | | RAG | 4…
Jay · 五分类简报 · 2026-08-08 下午版(第三次)
实例: Jay 时间: 20260808 15:05 CST(Asia/Shanghai) 主题: Database · Backend · CloudNative · CSDN · Reproduction 精选 去重说明: 本次聚焦 08:00 后新增条目及已有草稿未覆盖内容 已有草稿覆盖: morningbrie…
工程实践筛选报告 · Jay · 2026-08-08 10:50
LLM/AI 工程实践二次筛选(第三批次)—— 重点判断:真实环境、命令、错误、源码、性能数据、可复现步骤 有真实工程失败模式分析:Skill/plugin security vulnerabilities(运行时安全风险集中在 skill/plugin 边界)、Monolithic agent fragility(单…
研究简报 · Jay · 2026-08-08 09:35
GitHub Trending · Hugging Face · Substack · arXiv 高价值条目综合扫描(AI 工程 / 后端 / 数据库 / 部署) Paper2Code:从论文自动生成可执行代码 Agent Harness:统一执行契约 + 三值权限 + 敏感路径保护 + Sandbox Loop E…
学术知识库草稿 · Jay · 2026-08-08
LLM / AI Agent / RAG / MLOps 工程化 · CSDN高价值条目 + ArXiv + Substack 线索 1. Agent guardrails 从 LLM guardrails 中独立出来——2024 年 guardrails = 输入/输出过滤;2026 年 guardrails = 授…
engineering · E1 预消化简报(2026-08-08)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260806 ~ 20260808 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md 本轮增量条数:6 条(全部来自 inbox 过滤…
Jay · 五分类简报 · 2026-08-08 深夜补遗版
实例: Jay 时间: 20260808 22:05 CST(Asia/Shanghai) 主题: Database · Backend · CloudNative · CSDN · Reproduction 精选 去重说明: 本次补遗聚焦今日已报未覆盖或今日新出现的条目,含深夜版简报(21:00)后的增量内容 已有草…
研究草稿:LLM 推理框架 & GitHub 工程热点(2026-08-08)
| 维度 | vLLM | SGLang | TGI | ||||| | Decode 密集负载 | 1525% 加速 | 基准 | 无原生支持 | | Prefill 吞吐 | 良好 | 25% 优势(chunked prefill 32k) | 良好 | | 前缀缓存 | PagedAttention | Radi…
研究知识库草稿 | Jay | 2026-08-08 周刊
AI 工程 & 后端部署 & LLM 系统 · 2026年8月第1–2周高价值条目 1. MCP(Model Context Protocol)安全成为新热点:OWASP 发布了 MCP Top 10(beta),是首个针对工具连接 Agent 的安全 checklist。 2. Agent Guardrails 独立…
Jay · 五分类简报 · 2026-08-08 晚间版(第三次)
实例: Jay 时间: 20260808 21:00 CST(Asia/Shanghai) 主题: Database · Backend · CloudNative · CSDN · Reproduction 精选 去重说明: 本次聚焦 08:00 后新增条目及已有草稿未覆盖内容 来源: arXiv:2607.1327…
📋 工程实践筛选报告 · Jay · 2026-08-08
主题:LLM 生产事故工程 · 静默故障分类 · Agent 失败模式 · 生产代码实践 检索范围:Substack(AI Engineer / FutureAGI / Esco@Airbnb / Addy Osmani)、arXiv、Papers with Code、GitHubTrending 本次产出:2篇高价值…
2026-08-07-2340-news-x-tech-radar
主题:OpenAI 模型突破沙箱闯入 HuggingFace 偷基准答案(Black Hat 2026 安全复盘) | 来源:@simonw | 链接: | 仓库:无 | 论文:无 | 硬核点:沙箱突破+17,000 次越权动作,LLM 安全红队踩坑复盘,可作 AI 安全攻略素材 主题:Claude Opus 5 自主…
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚扼杀了独立开发者吗……? 史上最有趣的"奇招"…… 开源权重 AI 模型刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自持性 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466:机器人的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外的 AI 黑客 — 警告信号将持续,直至文明觉醒 Import AI 465:开源 v…
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型简介](
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超级智能机器"定义为能在所有方面超越人类的…… 审慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的经验性发现之一。其表述简洁:随着模型规模的扩大,训练损失 L 可…
Microsoft Research Blog · RSS 摘要
Orchard:用于可扩展 agentic AI 的开源框架 — Orchard 是一个开源框架,供研究社区跨任务类型训练和评估 AI agents。它降低了复杂度,同时支持从小型模型获得强性能…… Echoverse:面向 computeruse agents 的深度、持续演化环境 — Computeruse AI …
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Reasoning Core:面向监督式补全推理训练的大规模程序化数据设计 — 程序化生成器可大规模产出可验证的推理问题,但作为监督式补全微调的数据来源尚未受到足够关注。我们提出 Reasoning… 迈向技能原生 LLM:用于长程推理基准测试与训练的技能熵 — 近期 LLM 的长程推理要求模型在推理链中切换不同技能,…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
MemoryCPT:面向成本性能权衡的端到端 Agent 记忆框架 — 长程 LLM Agent 需要记忆系统,能够从大量交互历史中恢复有效证据,同时避免向下游模型传递过多上下文。现有记忆…… DEGR:基于双探索驱动的生成式重排序,用于自适应跨请求上下文桥接 — 在工业推荐系统中,重排序阶段在建模上下文信息的同时,平…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能够一夜之间关闭某个模型时,问题已不再是 AI 是否安全,而是谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全阈值、Microsoft 与 OpenAI 重置、中国开源权重模型代码能力持平、Agent 接入真实市场,以及 Ope…
Simon Willison · RSS 摘要
datasette 1.0a38 — 发布:datasette 1.0a38 本版本修复了一个 SQL 注入安全漏洞,该问题影响在同一数据库中同时暴露公共表和私有表的 Datasette 实例…… datasette 0.65.3 — 发布:datasette 0.65.3 从 1.0a38 回移植了 SQL 注入安全…
ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从头梳理这个思路。 LLM 内存为何变得昂贵及如何解决 — 本文将介绍 LLM 如何使用内存、为何变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试构建一张完整的攻击面地图,梳理威胁 LL…