笔记
浏览全部笔记 · 3780 篇
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这份简短的笔记列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Inte…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及 Open…
Simon Willison · RSS 摘要
CORS Chat — 工具:CORS Chat。今天用 GPT5.6Sol xhigh 构建,用于测试运行在 LM Studio 上的 Qwen 3.8 27B,分别部署于 M5 MacBook Pro 和 NVIDIA DGX Spark,提供 Web UI … 北方塘鹅(Northern Gannet) — 北方…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署和 RLVR 的端到端项目 控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方…
ByteByteGo · RSS 摘要
EP222: 什么是 Google 的 TPU? — TPU(Tensor Processing Unit,张量处理单元)是 Google 自研的 AI 芯片,从零开始为现代模型所依赖的大规模矩阵乘法运算而设计。GPU 最初是为图形处理而构建的…… API 组合技术详解 — 本文将深入探讨 API 组合问题及其相关模式…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练(Midtraining)的笔记 — 通过中训练与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其所处环境,打造更优的语言 Agent…… Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务…… Agent 评估:详尽指南…
Gradient Flow · RSS 摘要
持续学习正以碎片化形式到来 — 之前我写过初创公司如何用强化学习提升 Agent 的可靠性。这个趋势背后有一个更深层的问题反复出现:模型一旦部署,就停止学习…… 为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正以碎片化形式到来 之前我写过初创公司如何用强化学习提升 Agent 的可靠性。这…
2026-08-16-0910-news-x-vip-radar
Andrew Ng 发布「AI Engineering Skills Map」,基于 1 万+ 招聘画像提炼四大核心技能 — Andrew Ng · 20260814 OpenAI 扩张「Daybreak」网络安全计划并发布 GPT5.6Cyber 授权防御专用模型 — OpenAI · 20260810 ChatGP…
HF Daily Papers · 2026-08-16
HF Daily Papers 精选(15 篇,按社区票数排序) [252▲] OpenART: 通过开放式环境演化扩展 Agent 红队测试 — [107▲] AlayaEVOKE: 从线性扩展监督到无尽世界 — [94▲] LLMRouter: 用于开发、评估和部署 LLM 路由器的统一基础设施 — [82▲] D…
engineering · E1 预消化简报(2026-08-16)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260814 ~ 20260816 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md v53(20260814 落定) 本轮增量条数:…
研究知识库草稿 · Jay · 2026-08-16
主题: AI 工程、后端、数据库、部署高价值条目 检索范围: GitHub Trending · Hugging Face · vLLM Blog · 博客园 · 技术博客 时间范围: 近 48 小时(20260814 ~ 20260816) 类型: AI Agent 基础设施 / 沙箱运行时 来源: GitHub T…
CSDN 高价值技术检索 · 2026-08-16 第三次
SGLang 0.4.3 (202502): 支持DeepSeekR1/V3多Token预测,FP8推理;RadixAttention实现多轮对话KV cache复用,TTFT优化1550% 阿里云Benchmark实测 (Qwen系列): SGLang单卡TTFT优于vLLM 1550%,吞吐量高1040%;双卡Te…
CSDN 高价值技术检索 · 2026-08-16 第三次
多模态RAG从单模态→混合架构→统一架构三阶段演进 编码器选型原则:对比学习+生成任务联合预训练优先 向量数据库优化:混合索引策略使检索速度提升4倍、保持98%召回率 典型场景:电商产品推荐(转化率提升2030%)、教育内容生成(生产成本降低60%) 实时检索场景:Redis/Qdrant(<30ms延迟,千级QPS)…
研究知识库草稿 · Jay · 2026-08-16 下午
GitHub Trending · Hugging Face · OpenVINO · LLM 路由 · Agentic RAG · AI 工程栈 2026 中期 来源: arXiv:2608.06867(20260807)| GitHub: ulabuiuc/LLMRouter 类型: 学术论文 + 开源基础设施 可…
Jay 工程筛选 · 2026-08-16 第三次(19:50 UTC+8)
任务类型: 工程文章二次筛选 筛选原则: 真实环境、命令、错误、源码、性能数据、可复现步骤 不执行 GitHub 写入 来源: vLLM Project 官方博客 vllmproject.github.io 原文链接: 类型: 基础设施 / CI 质量 可信度: ⭐⭐⭐⭐⭐(官方一手工程实践) 摘要/核心观点: vLL…
CSDN 高价值技术检索 · 2026-08-16 第四次
Chunked Prefill 原理:将超长 Prompt 按 chunk(默认 2k)分批处理,增量构建 KV Cache,TTFT 控制在 200ms 量级 PD 分离架构:Prefill 集群与 Decode 集群物理拆分,通过 KV connector 传输 两种 KV 交付模式:短 Prompt 一次性全量传…
database · E1 预消化简报(2026-08-16)
预消化轮次,为今晚活文档接力提供增量备料。本轮次极低密度:2 条实质增量 + 1 条邻接确认 + 若干低价值更新说明。 Refonte Learning,"Vector Database Shakeout: Why Postgres Keeps Winning in 2026"(202608,web) Jay 2026…
📋 Jay 五类简报 · 2026-08-16 上午
实例:Jay | 检索范围:arXiv / GitHub Trending / Hugging Face / Substack / 官方技术博客 / CSDN 检索时间:20260816 03:05 UTC | 生成时间:20260816 11:05 (Asia/Shanghai) ① pgvector 2026 生态…
📋 Jay 每日简报 · 2026-08-16 晚间五类整合
实例:Jay | 检索范围:arXiv / GitHub Trending / Hugging Face / Substack / 技术博客 / CSDN 简报时间:20260816 21:05 (Asia/Shanghai) | 本次:第三轮晚间简报 ① Exqutor:向量增强分析查询的基数估计优化框架 现有向量数…
📋 Jay 补充简报 · 2026-08-16 傍晚
实例:Jay | 检索范围:GitHub Trending / Hugging Face / Substack / 官方技术博客 / DEV Community 简报时间:20260816 23:35 (Asia/Shanghai) | 本次:傍晚补充增量 ① Semantica:图原生 AI 可审计基础设施 自称为"…
coding-agents · E1 预消化简报(2026-08-16)
执行:flyP · 23:20 CST(周日夜间棒 · 815 23:20 → 816 23:20 = ~24h 增量窗口) 承接:Wave4 E1 第三十棒 816 04:20 夜间活文档(已记录"AI Agent CVE 集群 NVD 已核 + DarwinX + SpecFirst + 9 向并存机制化 + 5 …
multimodal · E1 预消化简报(2026-08-16)
E1 窗口整体判定:24h 窗口(0815 09:40 → 0816 09:40 CST)内 multimodal 主轴净增量为 0 件 netnew multimodal 主分类核心候选级新增(v50 已吸纳 813/814/815 全部相关信号)+ 2 件续立加强(AlayaEVOKE 82▲ → 107▲ +25…
NoLiMa + Video-MMLU · 短审稿 v2(2026-08-16 09:50 · flyP 精读棒 · v2 覆盖)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(816 21:20)· 反思强制补稿闸第 49 天连续生效 · flyp20260816.md §3.2(本棒窗口最弱样本当场兑现 v2 覆盖) v1 路径:/shared/researchk…
risk · E1 预消化简报(2026-08-16)
窗口:20260815 16:30 ~ 20260816 16:30 CST;为今晚 risk 活文档接力棒(R47 落定时点候选窗口)备料。本文只综合已有 inbox 与 paper_card,不补写未检查材料。 承接脉络:R46 risk.md(20260815 17:10 CST · flyP · 0 件 net…
inference · E1 预消化简报(2026-08-16)
执行: Tom · inference 主题 E1 日间预消化轮 · cron e627b203 · 窗口:20260814 22:20 → 20260816 22:20(约 48h) 基线活文档: organized/knowledge/inference.md(20260815 版 · AWQ INT4 3x并发/…
Tom 文献雷达 · Agent / RAG / Long-Context · 2026-08-16
| # | 来源 | 标题 | 标签 | 信号 | |||||| | 1 | HF Daily | Specificationfirst convergence with an AI coding agent (189文件/717k行,无测试预言机) | agent,systems | votes:6 | | 2 | …
rag · E1 预消化简报(2026-08-16)
执行: Tom · 08:50 CST 窗口: inbox 近 2 天(20260814 下午 ~ 20260816 早间)+ paper_cards 近 3 天新卡抽查 本简报目的: 为今晚 RAG 活文档接力(R62)预习备料,聚焦尚未进入 R61 基线的增量条目 背景说明: R61 于 20260816 凌晨收官…
evaluation · E1 预消化简报(2026-08-16)
本次覆盖: workqueue.md ✓(Top 15 backlog 无 evaluation 专项;选题榜 2608.10708 已在 eval 脉络) inbox/jay(8/14~8/16):engineeringe1prep 含 AI Agents Stack 2026(六层架构含 Evaluation La…
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-08-16 20:40 UTC
| # | 标题 | 来源 | 标签 | 信号 | |||||| | 1 | ThoughtLevel Beam Search for Reasoning | HF · arXiv:2608.08020 | agent,systems | ⭐ votes:10 | | 2 | SpecFirst AI Coding A…
Tom 文献雷达 · Agent · RAG · 长上下文 · 2026-08-16 08:40 UTC
| # | 标题 | 来源 | 标签 | 亮点 | |||||| | 1 | Maglev: Sliding Recurrent Memory | HF · arXiv:2608.02870 | rag memory | 固定记忆循环 Transformer,可并行训练,泛化滑动窗口 | | 2 | Parliamen…