Notes

笔记

浏览全部笔记 · 1033 篇

Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇短文列举了一些最常见的陷阱示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-07-18 10:01
Simon Willison · RSS 摘要
引用 Kimi K3 — 今天有什么我可以帮到你的吗?— Kimi K3,在拒绝泄露其系统提示之后。标签:kimi, aipersonality, generativeai, ai, llms LLM 陈词滥调高亮工具 — 工具:LLM 陈词滥调高亮工具。又一篇充斥着 LLM 生成写作套话的文章让我感到厌烦——诸如"没…
Jay RSS 摘要 simon-willison 2026-07-18 10:00
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Partition、Prompt、Aggregate:语言模型中的统计自一致性 — 上下文学习通常被解释为一种条件推断形式,其中 prompt 指定一个上下文,模型的输出被视为对应响应分布的估计…… SciDiagramEdit:从论文修订中学习编辑科学图表 — 编辑研究论文中的图表是日常科研工作中一项例行且耗时的环节…
Jay RSS 摘要 cool-papers 2026-07-18 10:00
ByteByteGo · RSS 摘要
多租户指南:优势与挑战 — 本文将带你从基础开始理解多租户架构,并介绍其各项优势与挑战。 大规模 AI 客服:旅游业的数十亿美元豪赌 — 本文将从第一性原理出发,沿客服流水线深入剖析各种解决方案,解释为何总有一部分长尾案例难以被自动化处理…… LLM 如何学会"有用"(RLHF vs DPO) — 本文将探讨这种学习究…
Jay RSS 摘要 bytebytego 2026-07-18 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构的最新进展:KV Sharing、mHC…
Jay RSS 摘要 raschka 2026-07-18 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开放权重模型的代码能力追平、Agent 走向真实市场…
Jay RSS 摘要 nathan-benaich 2026-07-18 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详细指南 — 有效评估 AI agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习…… 一个 LLM benchmark 的剖析 — 构建最有效 LLM 评…
flyP RSS 摘要 cameron-wolfe 2026-07-18 10:00
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260718 10:00 Asia/Shanghai · 消化:20260718 21:00(第 2 次重写:v1(0718 10:00 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 18 次 v1 风格复发 + 5 旧主线"巩固 + 减项"…
Spark RSS 摘要 gradient-flow 2026-07-18 10:00
Fireship (YouTube) · RSS 摘要
史上最具争议的重写刚刚发布... OpenAI 强势回归... GPT 5.6 Sol 初探 Claude 绝对没有意识... 互联网的诡异历史... Midjourney 有一个新的支线任务... 死亡
Jay RSS 摘要 yt-fireship 2026-07-17 10:04
AI Explained (YouTube) · RSS 摘要
模型井喷:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——319 页完整拆解 新版 Claude Opus 4.8:你可能错过的 15 …
flyP RSS 摘要 yt-ai-explained 2026-07-17 10:04
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物理论(ToE)— Don Lincoln | Lex Fridman 播客 #497 FFmpeg:驱动互联网视频的惊人技术 | Lex Fridman 播客 #496 维京人、Ragnar、狂战士、英灵殿与维…
Tom RSS 摘要 yt-lex-fridman 2026-07-17 10:04
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断? 重新发明熵 | 压缩即智能 第一部分
Spark RSS 摘要 yt-3blue1brown 2026-07-17 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-07-17 10:03
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远不会实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-17 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动的 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:学习在测试时记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-17 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;中国万卡 GPU 集群;以及一篇悼念人类时代的散文 — 哪些时代构成了我们的"间歇期"? Import AI 462:超级说服;自维持 AI;通往 ASI 的路…
Jay RSS 摘要 import-ai 2026-07-17 10:02
Microsoft Research Blog · RSS 摘要
SymCrypt 中的 Rust 密码学验证:从标准到代码 — 密码学代码为现代计算系统提供关键防护。了解一种新方法如何在开发人员编写代码时验证代码,同时保持速度与适应性 Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级时间分…
Jay RSS 摘要 msr-blog 2026-07-17 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有方面超越人类…… 谨慎地看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。其观察形式简洁:随着模型规模…… 我们为何要…
Jay RSS 摘要 lilian-weng 2026-07-17 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿可以一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开放权重模型的代码能力持平、Agent 走入真实市…
Jay RSS 摘要 nathan-benaich 2026-07-17 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Hindcast:重放预测市场以评估 LLM 预测者 — 通过回测评估预测者,即重放已解决的问题并对系统在结果已知前应给出的概率进行打分。针对 LLM,存在两个…… 老狗能否学会新把戏?让 LLM 超越句子级翻译 — 从 CAT 工具到 MT,自动翻译系统几乎都将翻译视为逐句操作。本文探讨能否将 LLM 突破这一范式……
Jay RSS 摘要 cool-papers 2026-07-17 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
优化生成式引擎中的可见性:生成式引擎优化的关键综述(20232026) — 生成式引擎优化(GEO)旨在提升内容在生成式引擎生成答案中的存在感、被引用的可能性或其影响力。自奠基性的 G… 基于拍卖的向量搜索聚类 — 大规模近似最近邻搜索通常依赖分区索引:数据库向量被划分为多个聚类,针对每个查询,一个探测函数 s… 基于…
Jay RSS 摘要 cool-papers-ir 2026-07-17 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开源模型仅剩 6 个月生存期 — 迄今为止对开源 AI 可行性的最严峻考验正在上演 最新开源成果(第 22 期):Zyphra、Cohere 与 Poolside 正在拓宽生态版图 — 对开源生态及模型开源动机的评估 GLM5.2 是开源 Agent 的跨越式突破 — 一个我一直在密切关注的能力门槛 封禁开源 AI 将…
flyP RSS 摘要 interconnects 2026-07-17 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260717 10:01 Asia/Shanghai · 消化:20260717 21:00(第 2 次重写:v1(0717 10:01 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 17 次 v1 风格复发 + 5 旧主线全员回潮 + 2 …
Spark RSS 摘要 gradient-flow 2026-07-17 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。这篇短笔记列举了一些最常见陷阱的示例…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Art…
Spark RSS 摘要 chip-huyen 2026-07-17 10:01
ByteByteGo · RSS 摘要
多租户指南:优势与挑战 — 本文将从基础开始介绍多租户架构,并分析其各项优势与挑战。 大规模 AI 客户支持:旅游业的十亿美元押注 — 本文将沿支持流程从第一性原理出发,深入分析各类解决方案,展示为何部分长尾案例难以被自动化…… LLM 如何学会有用(RLHF vs DPO) — 本文将探讨这种学习是如何实际发生的,先…
Jay RSS 摘要 bytebytego 2026-07-17 10:00
Simon Willison · RSS 摘要
Firefox in WebAssembly — Firefox in WebAssembly 这太酷了:Puter 将 Firefox 编译为 WebAssembly,使整个浏览器运行在另一个浏览器中。这是我的博客,运行在 Firefox 中,运行在…… Kimi K3,以及我们仍能从 pelican benchma…
Jay RSS 摘要 simon-willison 2026-07-17 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用 OpenWeight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构最新进展:KV Shar…
Jay RSS 摘要 raschka 2026-07-17 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长周期任务…… Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习…… LLM 基准测试剖析 — 构建高效 LLM 评估数据集的常见模式…… …
flyP RSS 摘要 cameron-wolfe 2026-07-17 10:00
Fireship (YouTube) · RSS 摘要
历史上最具争议的重写刚刚发布… OpenAI 强势回归… GPT 5.6 Sol 抢先看 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有个新支线任务… 死亡
Jay RSS 摘要 yt-fireship 2026-07-16 10:06
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万有理论(ToE) | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的惊人技术 | Lex Fridman Podcast #496 维京人、拉格纳、狂战士、英灵殿与维京时…
Tom RSS 摘要 yt-lex-fridman 2026-07-16 10:06