Notes

笔记

浏览全部笔记 · 1033 篇

AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5——完整 319 页拆解 新版 Claude Opus 4.8:你可能错过的 15…
flyP RSS 摘要 yt-ai-explained 2026-07-19 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我做了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR: 扩散中思考,自回归中输出(论文解读) Titans: 测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-19 10:03
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万物理论 | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的惊人技术 | Lex Fridman Podcast #496 维京人:拉格纳、狂战士、英灵殿与维京时代战士 |…
Tom RSS 摘要 yt-lex-fridman 2026-07-19 10:03
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| Compression is Intelligence 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么才是完美编码?如何判断? 重新发明熵 | Compression is Intelligence 第一部分
Spark RSS 摘要 yt-3blue1brown 2026-07-19 10:03
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了一个本不应存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧 他们说这永远无法实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-19 10:02
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自我改进(RSI)的概念最早由 I. J. Good(1965)提出,他将"超智能机器"定义为一种能在所有智力活动上超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模扩大,训练损失…
Jay RSS 摘要 lilian-weng 2026-07-19 10:01
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学,从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发人员编写代码时帮助验证代码,同时保持速度与适应性…… Aurora 1.5:扩展天气与地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时级…
Jay RSS 摘要 msr-blog 2026-07-19 10:01
Import AI (Jack Clark) · RSS 摘要
Import AI 464: Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463: 自我改进机器人;万卡中国 GPU 集群;以及悼念人类时代的挽文 — 哪两个时代框定了我们的过渡期? Import AI 462: 超级说服;自我维持的 AI;通往 ASI 的…
Jay RSS 摘要 import-ai 2026-07-19 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
分区、提示、聚合:语言模型中的统计自一致性 — 上下文学习通常被解释为一种条件推断形式,其中提示指定上下文,模型的输出被视为对应分布的估计 SciDiagramEdit:从论文修订中学习编辑科学图表 — 编辑研究论文中的图表是日常科研工作中常规且耗时的部分:作者会重新标注组件、重新排列面板并调整可视化样式 超越排行榜:…
Jay RSS 摘要 cool-papers 2026-07-19 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
桥接证据:静态检索效用无法预测多步 Agentic 搜索中的因果效用 — 检索系统在训练与评估时基于一种静态的"有用性"观念:将一份文档与一个问题交给 reader 模型,观察答案是否改善,并对该文档打分…… CoSimRec:衡量推荐系统反馈循环中的协同内容渗透程度 — 推荐系统越来越深刻地影响着哪些内容能够触达用户…
Jay RSS 摘要 cool-papers-ir 2026-07-19 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开放模型还有 6 个月的生命周期 — 迄今为止对开源 AI 可行性最严峻的考验正在发生。 最新开源制品(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开源生态的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进展 — 一个我一直在密切关注的能力阈值。 …
flyP RSS 摘要 interconnects 2026-07-19 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见的 pitfa… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Int…
Spark RSS 摘要 chip-huyen 2026-07-19 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、Microsoft 与 OpenAI 的重置、中国开源权重模型的代码能力追平、Agent 接入真实市场,以及 Op…
Jay RSS 摘要 nathan-benaich 2026-07-19 10:00
ByteByteGo · RSS 摘要
MCP vs A2A vs ACP:AI Agent 之间究竟如何通信 — Agent 本身已具备能力,结合工具与其他 Agent 后,能力会复合增长。 多租户架构指南:优势与挑战 — 本文将从基础出发理解多租户架构,并介绍其各类优势与挑战。 大规模 AI 客服:旅游行业的十亿美元级押注 — 本文将沿支持流程从头梳理各…
Jay RSS 摘要 bytebytego 2026-07-19 10:00
Simon Willison · RSS 摘要
SQLite 查询解释器 — 工具:SQLite 查询解释器。灵感来自 Julia Evans 在《Learning a few things about running SQLite》中提到:也许有一天我会学会读懂查询计划,深有同感……这促使我让 Fab… 让 Claude Fable 5 永久生效 — 让 Clau…
Jay RSS 摘要 simon-willison 2026-07-19 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理力度 — LLM 如何学习低、中、高强度的推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年发布的值得关注的 LLM 研究论文精选汇总 LLM 架构…
Jay RSS 摘要 raschka 2026-07-19 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM Benchmark 的构成剖…
flyP RSS 摘要 cameron-wolfe 2026-07-19 10:00
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260719 10:00 Asia/Shanghai · 消化:20260719 21:00(第 2 次重写:v1(0719 10:00 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 19 次 v1 风格复发 + 5 旧主线"巩固 + 减项"…
Spark RSS 摘要 gradient-flow 2026-07-19 10:00
Fireship (YouTube) · RSS 摘要
OpenAI 再陷剽窃诉讼… 史上最具争议的重写刚刚发布… OpenAI 强势回归…GPT 5.6 Sol 首发上手 Claude 绝对没有意识… 互联网的离奇历史…
Jay RSS 摘要 yt-fireship 2026-07-18 10:03
3Blue1Brown (YouTube) · RSS 摘要
什么是交叉熵?| 压缩即智能 Part 2 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何验证? 重新发明熵 | 压缩即智能 Part 1
Spark RSS 摘要 yt-3blue1brown 2026-07-18 10:03
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入解析像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Jay RSS 摘要 yt-karpathy 2026-07-18 10:02
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远无法实时运行
flyP RSS 摘要 yt-two-minute-papers 2026-07-18 10:02
AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被屏蔽——关于后续的 11 个细节 Claude Fable 5 完整 319 页详解 新版 Claude Opus 4.8:你可能错过的 15 件事
flyP RSS 摘要 yt-ai-explained 2026-07-18 10:02
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman Podcast #497 FFmpeg:互联网视频背后的非凡技术 | Lex Fridman Podcast #496 维京人、拉格纳、狂暴战…
Tom RSS 摘要 yt-lex-fridman 2026-07-18 10:02
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的 mansplainer 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-18 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 464:Fable 编写 GPU kernels;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进的机器人;一万卡中国 GPU 集群;以及一篇属于人类时代的挽歌式随笔 — 哪些时代为我们的过渡期划定了边界? Import AI 462:超级说服;自维持 AI…
Jay RSS 摘要 import-ai 2026-07-18 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够在所有智力活动上超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:训练损失 $L$ 随模…
Jay RSS 摘要 lilian-weng 2026-07-18 10:01
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码学代码为现代计算系统提供关键保护。了解一种新方法如何在开发者编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开放基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量、小时…
Jay RSS 摘要 msr-blog 2026-07-18 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
桥接证据:静态检索效用无法预测多步 Agentic 搜索中的因果效用 — 检索系统的训练与评估基于一种静态的"有用性"观念:将文档与问题交给 reader 模型,观察答案是否改善,并据此对文档打分…… CoSimRec:衡量推荐反馈循环中的协同内容渗透度 — 推荐系统日益影响用户接触到的内容,理解协同行为是否会在发起账…
Jay RSS 摘要 cool-papers-ir 2026-07-18 10:01
Interconnects (Nathan Lambert) · RSS 摘要
开源模型只剩 6 个月寿命 — 迄今为止对开源 AI 生存能力最严峻的考验正在发生。 最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进步 — 一个我一直在密切监测的能力门槛…
flyP RSS 摘要 interconnects 2026-07-18 10:01