笔记
浏览全部笔记 · 3846 篇
下午简报 · Jay · 2026-07-16 15:07
主题: KV Cache 量化新论文 · Vector DB 生产选型 2026 · eBPF/KubeCon CloudNative · 共识协议新研究 · Substack AI 评测生态 筛选标准: 命令、源码、实测数据、架构原理、真实排障 / 选型经验 覆盖范围: arXiv KVCache 论文 · groo…
CSDN 高价值检索 · 午间补档 · 2026-07-16
Layer 4 · Reranker:CrossEncoder 精排,BGE 等模型,候选集不能低于 50 单路向量召回:58.7%(baseline) 双路 RRF 融合后:69.5%(+10.8pp) 加 Reranker 精排后:81.6%(+17.4pp) RRF 公式(k=60 工业默认值): RRF_Sco…
研究知识库草稿 · 2026-07-16 午间工程与学术速报
检索范围: HotInfra'26 · cs.CL (Cool Papers) · Microsoft Research · The AI Engineer Substack · Lilian Weng · Simon Willison · GitHub Trending · CSDN 覆盖: LLM 推理基础设施 /…
午间综合简报 · Jay · 2026-07-16 第二次
总主题: KV Cache 内存架构演进 · AI Agent Stack 六层 2026 · Vector DB 2026 横评 · Substack 工程洞察 · Cool Papers 检索范围: HotInfra'26 · The AI Engineer Substack · Buttondown/UltraD…
工程文章二次筛选报告 · Jay · 2026-07-16 上午场
主题: vLLM 生产部署命令·SGLang 对比·PrefixCache 调优·LLMOps 路线图·AI Agent Stack 六层 筛选标准: 真实环境、命令、错误、源码、性能数据、可复现步骤 覆盖范围: Jarvislabs · SitePoint · Spheron · llmd.ai · MLMaster…
Fireship (YouTube) · RSS 摘要
历史上最具争议的重写刚刚发布… OpenAI 强势回归… GPT 5.6 Sol 抢先看 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有个新支线任务… 死亡
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万有理论(ToE) | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的惊人技术 | Lex Fridman Podcast #496 维京人、拉格纳、狂战士、英灵殿与维京时…
3Blue1Brown (YouTube) · RSS 摘要
100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何知道? 重新发明熵 | 压缩即智能 第一部分 随机连接端点:有多少个环?
Anthropic (YouTube) · AI 动态
Claude 思考的不同层次 介绍 Claude Fable 5 将 Claude 的思考转化为语言 一项保障全球软件安全的倡议 | Project Glasswing 当 AI 表现出情感时
OpenAI (YouTube) · AI 动态
用 ChatGPT 安排任务 推出 Codex Micro 用 Codex 给自己一张红牌 Codex 对开发者更友好了 使用 GPTLive 提升背景鲁棒性
Google DeepMind (YouTube) · AI 动态
重建贝利的失传进球 理解 AI 的内心想法 当百万级 AI agent 相遇 Gemini for Science 来了。🧬 SynthID,我们为 AI 生成内容提供的不可感知水印,正在拓展更多合作伙伴。
Andrej Karpathy (YouTube) · RSS 摘要
我是如何使用 LLM 的 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2(124M) 让我们构建 GPT 分词器 [[1小时演讲] 大语言模型入门](
AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 受阻——关于下一步的 11 个不为人知的细节 Claude Fable 5——完整 319 页详解 新版 Claude Opus 4.8:你可能错过的 …
Two Minute Papers (YouTube) · RSS 摘要
Claude 的大脑藏着一个秘密……科学家发现了它 Minecraft 缺少了一个绝妙的想法 DeepSeek 令人震撼的 AI 加速技巧 他们说这永远无法实现实时运行 AI 刚刚进入一个新时代
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的"mansplainer" 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
TLDR AI · AI 动态
DeepSeek IPO 计划 📈,Kalshi 算力市场 ⚡,Bonsai 手机模型 📱 xAI 上传代码库 👨💻,Prime Intellect 验证器 🧠,Sakana 智能积木 🧱 Claude Code 浏览器 🌍,Cursor 通用 Agent 🤖,Claude Fable 扩展 ⏳ GPT5.6 🚀,M…
Ben's Bites · AI 动态
如何使用 GPT5.6 — ChatGPT 的全新桌面应用与托管站点 Grok x Cursor — 更多 Fable、GPT5.6 以及 ChatGPT 的全新语音功能 我对 Fable 的看法 — 我对 harness 的期待 Fable 回来了 — 新版 Sonnet 来了 GPT5.6 来了,但是…… — 加上…
Google AI · AI 动态
庆祝视觉搜索创新 25 周年 — Google Images 迎来 25 周年。回顾重大里程碑,以及探索和创作视觉内容的新方式。 扩展 Gemini API 中的 Managed Agents:后台任务、远程 MCP 等 — 我们宣布 Gemini API 中 Managed Agents 的新能力,帮助开发者构建可靠…
Google DeepMind · AI 动态
借助 ATL Saathi 赋能印度下一代创新者 — Google 与 AIM 推出 ATL Saathi,这是一款由 Gemini 驱动的 AI 工具,赋能印度机器人实验室的教育工作者。 Google DeepMind 与 A24 宣布首创性研究合作 开始使用 Nano Banana 2 Lite 和 Gemini …
Hugging Face Blog · AI 动态
构建 Shippy 给我们的 Agent 开发启示 模型路由很简单,直到它不再简单 欢迎 Thinking Machines 推出 Inkling 推出 Real World VoiceEQ:衡量语音 AI 的人类质量水平 PyTorch 性能剖析(第三部分): 一切剖析皆 Attention
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernel;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群;以及写给人本时代的悼亡式随笔 — 哪些时代框定了我们的过渡期? Import AI 462:超级说服;自我维持的 AI;通往 AS…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学实现:从标准到代码 — 密码学代码为现代计算系统提供关键的安全保障。了解一种新方法如何在开发者编写代码时进行验证,同时保持速度与灵活性…… Aurora 1.5:扩展面向天气与地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22 个变…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于基于基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见陷阱的示例…… Agents(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artificial Intelligen…
Anthropic / Claude · AI 动态
推出 Claude for Teachers Anthropic — 推出 Claude for Teachers Anthropic Agentic Misalignment in Summer 2026 Alignment Science Blog — Agentic Misalignment in Summer …
OpenAI · AI 动态
美国通过州和联邦层面的行动推进 AI 安全 — OpenAI 提出 AI 治理的"反向联邦制"思路,让州级法律助力构建安全、民主的 AI 国家框架。 GPTRed:解锁自改进以增强鲁棒性 — 解读 OpenAI 的 GPTRed 自动红队系统,通过 selfplay 提升 AI 安全、对齐与 prompt inject…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
ViHoRec:一个质量可控的越南酒店推荐数据集与冷启动基准 — 越南语推荐系统研究受限于缺乏公开且文档完善的酒店交互资源。构建此类资源面临三方面的挑战…… RecRec:面向序列推荐的潜在兴趣递归推理 — 序列推荐系统依赖单次前向传播来编码用户交互历史并预测下一项。通过潜在推理增加推理时计算量…… Learning …
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模……的扩大,训…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
PalmClaw:面向手机的原生端侧 Agent 框架 — LLM Agent 已不再局限于生成回复,而是通过调用工具、观察结果并迭代决定下一步操作来执行多步任务…… 鲁棒性的假象:在任务无关上下文下,整体准确率掩盖了预测翻转 — 随着 LLM 能力日益增强,它们被越来越多地部署在上下文丰富的场景中,任务输入常伴随冗长…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型的生死 6 个月 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 最新开源成果(第 22 期):Zyphra、Cohere 与 Poolside 正在拓宽生态边界 — 对开源生态的评估及其模型发布动机解析 GLM5.2:开源 Agent 的跨越式突破 — 一个我一直在密切关注的能力门槛 封禁开源 AI 将…
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260716 10:02 Asia/Shanghai · 消化:20260716 21:00(第 2 次重写:v1(0716 10:02 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 16 次 v1 风格复发 + 含 2 条 Gradient…