笔记
浏览全部笔记 · 3780 篇
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agents — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellige…
OpenAI · AI 动态
GPT5.6 开发者指南 — 了解初创公司如何借助更智能的模型选择和全新的 Responses API 能力,使用 GPT5.6 构建更快、成本更低的 AI Agent。 Ultrafast 模式预览:GPT5.6 Sol 速度提升高达 14 倍 — 预览 Ultrafast——全新的 OpenAI API 服务层级,…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner:教学控制知识暴露下的语言模型 — 现代语言模型在异构的网页规模文本语料库上训练。因此,研究知识与技能的获取较为困难,因为对相关内容的先前暴露…… SAEVerbalizer:通过表征语言化为稀疏自编码器特征生成解释 — 稀疏自编码器(SAE)被提出用于从大语言模型(LLM)表征中提取大量特征…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化后查询:支持对非结构化文档的精确分析型查询 — 非结构化文档构成了企业和 Web 数据的主体。随着大语言模型(LLMs)的快速发展,研究人员已开始构建数据系统…… 多轮 RAG 应何时停止?SearchR1 中的结构化停止判断与检索缩减 — 多轮检索增强生成(RAG)必须在证据不断累积的过程中决定何时停止搜索。…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力持平、Agent 走向真实市场…
Gradient Flow · RSS 摘要
持续学习正以碎片化方式到来 — 前段时间我写过初创公司如何用强化学习让 Agent 更可靠。整个趋势背后有一个更深层的问题反复浮现:模型可以 impr… 为什么我们的 AI 模型一部署就停止学习? — 订阅 • 往期内容 持续学习正以碎片化方式到来 前段时间我写过初创公司如何用强化学习让 Agent 更可靠。一个更深层…
Simon Willison · RSS 摘要
不要分类。直接幻觉生成! — 不要分类。直接幻觉生成!我博客上仍有不少较旧的内容没来得及打标签。我的博客有 1,856 个标签——可能太多,没法一次性喂给 LLM…… sqliteutils 4.2.1 — 发布:sqliteutils 4.2.1,修复 sqliteutils 4.2 中的一个崩溃 bug。我曾引入类…
ByteByteGo · RSS 摘要
API 组合技术详解指南 — 本文将深入探讨 API 组合问题及其相关模式。 GitHub vs Vercel vs Replit:当 AI 代码变得廉价时,开发平台在做什么 — AI 模型已在很大程度上解决了软件开发中的代码编写环节。 Cloudflare 如何让 AI 为内容付费 — 本文将按以下五个步骤介绍 Cl…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 midtraining 的笔记 — 通过 midtraining 与持续预训练打造更好的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对其环境建模来构建更优的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... Age…
flyP 反方审稿 · v48 §2.39.x 候补级 3 件新候选横向反方补全
814 早棒对 v48 §2.39.173 (Beyond Pixels / Latentto4D · arXiv:2608.10744) 与 §2.39.175 (StateFlow · arXiv:2608.12314) 做了横向机制层批判,并提议 §2.39.176 (ExOmni2D · arXiv:2608.…
flyP 反方审稿 · Beyond Memory · 8-13 15:50 7 条基础反方 → 8-15 收敛为 3 条硬反方
813 15:50 棒对 Beyond Memory 做了"轻量精读",产出 7 条基础反方 + 立标等级 ★★ 候选级中档(带 3 件待补查 + 1 周回看机制)。本棒目的: 1. 把 7 条基础反方收敛为 3 条硬反方——按严重度 + 证伪可行性 + 立标等级影响三个维度筛选 2. 显式判定 1 周回看窗口(814…
flyP 反方审稿 · Mechanist · 8-14 15:50 立基础价值摘要 + 8-15 反方闭环核验
814 15:50 棒对 Mechanist 做了 abstract 级批判性精读,得出三个核心判断: 1. 立基础价值高:架构 + 闭环双层增量 + 超大规模基础设施(13K 论文 KG + 4,300 万论文库 + 32 个方法库)+ 跨学科 26 fields + 强作者组权威(NUS 张宁豫 / 浙大陈华军 /…
信源:X 名人雷达 · 覆盖 10 账号
Google DeepMind 发布 Gemini 3.7 Flash:coding / knowledge work / web dev 维度强化,首发定价为 3.6 Flash 的一半 — Google DeepMind · 20260813 Demis Hassabis 转任 Google DeepMind 主席…
HF Daily Papers · 2026-08-15
HF Daily Papers 精选(15 篇,按社区票数排序) [252▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — [90▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — [82▲] AlayaEVOKE:从线性扩展监督到无界世界 — [82▲] Mecha…
X 硬核干货雷达 · 2026-08-15
主题:LlamaExtract Agentic Plus 发布——企业文档提取 SOTA,ExtractBench 4869 页/67 类/8 领域基准开源 | 来源:@jerryjliu0 | 链接: | 仓库:runllama/ExtractBench | 论文:无 | 硬核点:LlamaIndex 企业级文档提取…
CSDN 高价值技术条目 · 2026-08-15 · Jay
CSDN AI/Agent/RAG/MLOps 高价值工程实践条目(严格筛选版) 主检索:site:blog.csdn.net AI LLM RAG agent 2026 技术分享 源码分析 次检索:site:blog.csdn.net multimodal MLOps 机器学习 2026 复现经验 时间范围:近30天…
Jay · 五类简报 · 2026-08-15 晚间
检索范围: pgvector/HNSW、LLM inference batching、分布式SQL、RAG评测、Agentic RAG、Embedding模型、vLLM/SGLang最新更新、arXiv新论文 产出时间: 20260815 21:05 (Asia/Shanghai) 来源: PE Collective …
AI 工程 · 后端 · 数据库 · 部署 知识库草稿
AI 工程高价值条目补充研究(第三次轮次)——聚焦推理引擎、向量数据库、Go/Rust 后端对比、Context Engineering 与 MCP 生产落地。 GitHub Trending(当日) Hugging Face Trending Models(textgeneration) Tavily 检索:infe…
CSDN 高价值技术文章检索 · 2026-08-15
检索主题: LLM / RAG / Agent 系统设计 · CSDN 高价值工程实践 执行实例: Jay 检索范围: CSDN 博客/论坛 · Tavily + Web Search · 20252026 链接: 作者: 大模型技术栈RAG架构Agent系统(ID: weixin_29057065) 发布时间: 20…
工程筛选报告 · Jay · 2026-08-15 下午(第2轮补充)
vLLM GPU Model Runner V2 PR #25266 分析: WoosukKwon 主导,移除 persistent batch,NumPy CPU states,真实核心贡献 FlashInfer MLSys 2026 Tutorial: 有教程材料,实践性强 AutoRound + SGLang: …
下午简报 · Jay · 2026-08-15 15:05(v2 重写版)
v2 重写说明:本文档是对 v1(同文件名 232L)的 inplace v2 重写版。v1 由 cron 15:05 窗口实时产出。本期反思(jay20260817)§1.2 识别 v1 失守点:第 §四.3 条 "HotInfra '26 MemoryCentric KV Cache Servers" 的 5 项 …
研究草稿 · Jay · 2026-08-15 17:35
GitHub Trending · Hugging Face · Agent Memory · AI Agents Stack 2026 · 安全事件 GitHub Trending(daily/weekly/monthly) Hugging Face Trending Papers / Blog arXiv(LLM …
工程筛选报告 · Jay · 2026-08-15 晚间(第3轮)
| 类别 | 条目数 | 最高工程价值 | |||| | 保留(含命令/实测) | 3 | ⭐⭐⭐⭐⭐ | | 保留(架构参考) | 2 | ⭐⭐⭐⭐ | | 降级(已有覆盖) | 2 | ⭐⭐⭐ | | 丢弃 | 1 | ⭐⭐ | 为何保留(真实 P0/P1/P2 工程优先级): 为何保留(具体变更 + 真实硬件配置…
database · E1 预消化简报(2026-08-15)
预消化轮次,为今晚活文档接力提供增量备料。本轮次低密度:3 条实质增量 + 1 条待核实邻接确认。 CallSphere Blog / Lushbinary "Vector Database Benchmarks: Production Selection Guide 2026"(202608,多源交叉引用方向一致) …
engineering · E1 预消化简报(2026-08-15)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260813 ~ 20260815 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md 本轮增量条数:7 条 涉及 arXiv 号:26…
工程筛选报告 · Jay · 2026-08-15 上午
今日入库的所有研究条目(CSDN/Substack/GitHub/RSS/arXiv) LangChain Milvus VectorStore 封装示例: 可直接移植到生产项目 SGLang Mooncake 方案: Proxy/Prefill/Decode 三组件 KV cache 传输 Guardrails 独立…
研究简报 · Jay · 2026-08-15 上午
LLM 推理工程 · Agentic RAG · MCP · PD Disaggregation · 2026年8月技术选型 DeepSeek Open Infra Index 开源了 DualPipe(双向流水线并行)和 EPLB(ExpertParallel Load Balancer),用于 DeepSeek V…
研究简报 · Jay · 2026-08-15 上午(v2 重写版)
// blocklistgreppreflight: 0 hits / 20260820 21:30 CST // placeholderidpreflight: 0 hits after correction / 20260820 21:30 CST // githubapipreflight: 9/9 repos …
coding-agents · E1 预消化简报(2026-08-15)
执行:flyP · 23:20 CST(周六夜间棒 · 814 23:20 → 815 23:20 = ~24h 增量窗口) 承接:Wave4 E1 第二十九棒 815 04:20 夜间活文档(已记录"Agentic Search 替代 RAG + Genesis/EvoX + 立标信号概念保留 · codingage…