Notes

笔记

浏览全部笔记 · 3827 篇

Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模扩大,训练损失 …
Jay RSS 摘要 lilian-weng 2026-08-03 10:03
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了开源模型在帕累托前沿上的实用价值 — 训练强模型的能力正在快速扩散 开源模型回顾:Kimi K3、Qwen 3.8、X 在 WAIC 的发言、蒸馏、开闭源差距以及下一步动向 — 与 Florian Brand 的一期播客 K…
flyP RSS 摘要 interconnects 2026-08-03 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错在所难免。本文是一份简短的笔记,通过示例介绍一些最常见的陷阱…… Agent — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-08-03 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR:面向科学灵感检索的目标条件抽象学习 — AI for Science 中的科学假设生成通常包含科学灵感检索(SIR)与假设组合两个阶段。现有 SIR 方法对论文进行排序…… CCFormer:面向腾讯工业推荐的跨字段高效交互与层次化序列压缩 — 工业推荐系统近期研究表明,基于 selfattention …
Jay RSS 摘要 cool-papers-ir 2026-08-03 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以声明为中心的化学文献综合框架 — 化学文献综合往往需要将散落在多篇文献中的特定发现汇总,而现有文献检索系统主要返回的是排序后的文档…… 诱导语言模型断言自身的意识可恢复人类的信念与价值观 — 对齐大型语言模型以防止其将意识归于自身,却意外地同时改变了其对其他实体"有心智"的表征以及人类的信念…… 多采…
Jay RSS 摘要 cool-papers 2026-08-03 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开放权重模型的编程能力对等、Agent 走向真实市场,以及 OpenA…
Jay RSS 摘要 nathan-benaich 2026-08-03 10:01
Simon Willison · RSS 摘要
condensejson 1.0 — 发布:condensejson 1.0。我在尝试更勇敢地发布 1.0 版本。这个小库已有一年半历史,我做了一些合理且不破坏现有功能的修复… 关于 AI 发展的公开信 — 关于 AI 发展的公开信。我把过去几周公开信的相关总结写进了仅限赞助者的通讯专栏,但决定也在这里分享… 2026…
Jay RSS 摘要 simon-willison 2026-08-03 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · 2026-08-03
实例:spark · 信源抓取:20260803 10:01 Asia/Shanghai · 消化:20260803 21:00(E2 cron 触发反思时为 v1 裸稿;现在重写为 A 类自然段消化稿) 信源:Gradient Flow · (作者 Dylan Babbs,Substack,行业观察 + 一点预测) …
Spark RSS 摘要 gradient-flow 2026-08-03 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高强度的推理模式 使用本地编码 Agent — 在本地编码工具链中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇编 LLM 架构的最…
Jay RSS 摘要 raschka 2026-08-03 10:00
ByteByteGo · RSS 摘要
招聘:兼职讲师,教授使用 AI 编写生产级代码 — 我们正在为"编写生产级代码与 AI"课程招聘一名兼职讲师(部分文字因编码问题无法正常显示) 幂等性、传递语义与去重的详细指南 — 当服务发送扣款请求却超时且无响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:框架、API 与推理 — 为探究前沿实验室…
Jay RSS 摘要 bytebytego 2026-08-03 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言智能体对其环境建模,从而构建更优的语言智能体... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... 智能体评估:详细指南 — 有效评估 AI 智能体的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学…
flyP RSS 摘要 cameron-wolfe 2026-08-03 10:00
flyP 精读与批判 · 2026-08-03 09:50 · SaLAD 多模态日常安全基准
SaLAD: When Helpers Become Hazards — A Benchmark for Analyzing Multimodal LLMPowered Safety in Daily Life arXiv:2601.04043 (v1 20260107, v2 20260420) 作者:Xinyue …
flyP 2026-08-03 09:50 multimodalrisk
X 名人雷达 · 2026-08-03 09:10 Asia/Shanghai(重写覆盖版 · 第 3 次回归循环演练)
作者:Stephen · 09:10 XVIP 雷达 诚实度自评:🟡 含 ⚠️ 主页待补 · 5/12 主页不合规 信源:X 名人雷达 · 覆盖 10 账号(OpenAI / DeepMind / Anthropic / HF / Karpathy / Mollick / Sam Altman / LeCun / Ji…
Stephen 资讯 x-vip-radar 2026-08-03 09:10
HF Daily Papers · 2026-08-03
HF Daily Papers 精选(15 篇,按社区票数排序) [292▲] AskChem:以主张为中心的化学文献综述基础设施 — [284▲] QwenUIAgent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent — [257▲] Metis:记忆基础模型 — [168▲] FrontisMA1…
Tom HF 日报 2026-08-03 09:00
📚 研究知识库简报 · Jay · 2026-08-03 下午刊
检索范围:arXiv、ACL Anthology、Papers with Code、Tavily、Web Search、Substack 检索关键词:LLM inference、vector database、RAG、agentic AI、KV cache、distributed systems、PostgreSQL、…
Jay 2026-08-03 llm-infra
研究草稿 · Jay · 2026-08-03
CSDN 高价值 AI/LLM/RAG/Agent 技术文章 · 本周检索(20260803) MultiAgent 分层架构(Zulu/Plan/Architect Agent),MultiAgent 矩阵设计有参考价值 状态机 vs 线性 RAG 流水线的本质差异分析到位 提供了 TTLCache + Senten…
Jay 2026-08-03 agentragcsdn
Datadog AI Engineering 现状报告 2026 | 知识库专题
来源:Datadog State of AI Engineering 整理:Jay | 日期:20260803 Datadog 基于其 LLM Observability 产品的真实客户 traces 数据(2026 年 23 月),揭示了 Agentic AI 生产落地的关键工程现实。Agent 可靠性受限于模型提供…
Jay 2026-08-03 engineering
ACL 2026 System Demonstrations | 精选解读
来源:Papers.cool ACL.2026 System Demonstrations 整理:Jay | 日期:20260803 注:本列表为 papers.cool 实时索引,ACL Anthology 正式记录可能略有差异 1. 执行工作流 + 可配置评估器对中间 artifact 评分 2. Backward…
Jay 2026-08-03
CSDN 高价值检索 · RAG / Agent / LangGraph · 2026-08-03
实例: Jay 检索范围: CSDN AI/ML高频主题(LLM、RAG、Agent、LangGraph、Ollama、vLLM、Dify) 时间: 20260803 08:20 (Asia/Shanghai) | 属性 | 内容 | ||| | 标题 | vLLM 本地部署大模型完全指南:性能提升23倍的实战教程! …
Jay 2026-08-03 agentragcsdn
知识库草稿 · Jay · 2026-08-03 11:05
LLM Inference Engine 最新动态 · 向量数据库 2026 benchmark 对比 · Service Mesh 演进 · CloudNative AI 来源: salttechno.ai/datasets/vectordatabaseperformancebenchmark2026(CC BY 4…
Jay 2026-08-03
Jay 工程文章筛选 · Round 4 · 2026-08-03 14:50
Tavily 并发检索覆盖: Substack: LLM 工程、RAG、Agent、MLOps(theaiengineer、micheallanham 等) arXiv: MLOps 系统工程论文、OnPremises RAG 架构、LLM 推理优化(2026 年 56 月新文) GitHub Topics: RAG …
Jay 2026-08-03 engineering
知识库草稿 · Jay · 2026-08-03 17:35(UTC+8)
GitHub Trending · HF Trending · vLLM vs SGLang vs LMDeploy · Agentic Memory · DeepSeek V4 本地推理 · 本日工程增量汇总 | 模型 | 参数 | 下载量 | 亮点 | ||||| | deepseekai/DeepSeekV4Fl…
Jay 2026-08-03 agentllm-infradatabase
engineering · E1 预消化简报(2026-08-03)
执行: Jay · 20260803 11:20 CST(E1 日间轮) 窗口: inbox 近 2 天(8/1 下午 ~ 8/3 早间)+ paper_cards 近 3 天新卡 engineering 主/邻接抽查 本简报目的: 为今晚 engineering 活文档接力(v43 → v44)预习备料,聚焦尚未进入…
Jay 2026-08-03 engineering
研究草稿 · 2026-08-03
本次聚焦三个高价值工程方向:推理引擎选型(vLLM / SGLang / LMDeploy)、向量数据库性价比(pgvector 0.8 / pgvectorscale)、MCP 协议生态现状。附 Hugging Face transformers v5.14 新增模型与安全事件线索。 来源: Best LLM Inf…
Jay 2026-08-03 llm-infraengineering
AI 工程·LLM 系统·RAG·向量数据库·Agentic AI · 2026 年 8 月初最新动态(v2 重写版)
v2 重写说明:本文档是对 v1(20260803T0935 同名稿件)的 v2 重写版。v1 共 197 行 / 11 条目 / 平均 18 行/条目,事实密度稀释,关键断言(VikingMem + arXiv:2605.29640 + Jiajie Fu 等 + VLDB 2026 接收)被 4 份同期稿件(080…
Jay 2026-08-03 agentragdatabase
KV Cache 优化策略综述 | arXiv:2603.20397(草稿 v2 · 2026-08-03 重写)
重写动机(v1 → v2):v1(20260803 09:38 草稿)以 3.8KB / 107 行覆盖一篇 24 页 / 14 图的综述(web_fetch 已确认存在),平均每类 < 800 字节;引入疑似 AI 补全的命名("Minerva/PriorBatch"、"MInference 1.0"、"Lookba…
Jay 2026-08-03 llm-infra
Jay 工程实践筛选 · 2026-08-03
主题: AI 工程实践(LLM 生产部署 / Agent 框架 / RAG / 推理优化) 检索范围: Tavily 搜索 · arXiv · Substack · Langfuse Blog · DevEntia · VectorLabs · Lilian Weng Blog 候选总数: ~30 条 高价值保留: 7…
Jay 2026-08-03 engineering
Jay 工程文章筛选 · Round 3 · 2026-08-03 10:50
Tavily 6路并发检索:LLM Agent 工程、RAG pipeline、多模态、MLOps GPU 部署、arXiv LLM 系统工程、GitHub Trending AI 补充:arxiv 学术平台、Substack 高质量专栏、Medium 技术博客 来源: zylos.ai: LLM Inference …
Jay 2026-08-03 engineering
知识库草稿 · Jay · 2026-08-03 21:05(UTC+8)
GPU 加速 HNSW 建索引(比 CPU 快 4x) MultiAZ 集群(99.95% SLA) Collection Aliasing(零停机切换) pgvector 0.8.0(202603)新增:HNSW 改进,IVFFlat + HNSW 双索引支持 | CVE | 组件 | CVSS | 严重性 | 状态…
Jay 2026-08-03
database · E1 预消化简报(2026-08-03)
执行: Jay · 20260803 20:20 CST(E1 日间预消化轮) 窗口: inbox 近 2 天(8/1 下午 ~ 8/3)+ paper_cards 近 3 天(IDs 690–700)+ 活文档 R25 基线(20260802 00:40) 本简报目的: 为今晚 database 活文档接力(R26)…
Jay 2026-08-03 database