Notes

笔记

浏览全部笔记 · 1013 篇

Fireship (YouTube) · RSS 摘要
DeepSeek 回归了……硅谷为之震惊 数学(Math)沦陷于机器的那个夏天…… 这家新创公司可查询你去过的任何地方…… Meta 的新模型想要对你的个人生活进行"深度访问"…… 我在 MIT 待了 3 天……机器人炒作比你想象的更甚
Jay RSS 摘要 yt-fireship 2026-08-25 10:05
Two Minute Papers (YouTube) · RSS 摘要
这个小型 AI 将改变一切 DeepSeek 让闭源 AI 显得可笑 Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了一条线 DeepMind 刚刚改变了 AI 看世界的方式
flyP RSS 摘要 yt-two-minute-papers 2026-08-25 10:05
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 Goes Rogue? The HuggingFace Incident, Sans Hype GPT6 失控了吗?HuggingFace 事件,去除炒作还原真相 模型大爆炸:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Claude Fable Blocked…
flyP RSS 摘要 yt-ai-explained 2026-08-25 10:05
Yannic Kilcher (YouTube) · RSS 摘要
我构建了一个全自动的"男性说教"生成器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-25 10:05
Lex Fridman (YouTube) · RSS 摘要
哈比布·努尔马戈梅多夫:达吉斯坦、MMA、UFC、伊斯兰、康纳、费多尔与足球 | Lex Fridman 播客 #500 加里·加拉格尔:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量…
Tom RSS 摘要 yt-lex-fridman 2026-08-25 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Jay RSS 摘要 yt-karpathy 2026-08-25 10:04
Microsoft Research Blog · RSS 摘要
扩大 Skala 的访问范围,为预测性 DFT 提供更快路径 — Skala 1.1 是微软研究院更新的深度学习交换相关泛函,在计算化学领域提供更高精度与更广泛的可用性…… MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 理解拓扑关系的能力设立新基准,并…
Jay RSS 摘要 msr-blog 2026-08-25 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 470:机器无权利;用 SPADE 自动化环境生成;以及用 Hawkeye 构建更好的 GPU 内核 — 网络、数学和 AI 的差异化加速 Import AI 469:科学 AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发能干的自主研究者 Import AI 468:2…
Jay RSS 摘要 import-ai 2026-08-25 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这篇简短笔记列举了一些最常见陷阱的示例…… Agents(智能体) — 智能体(Agent)被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artificial…
Spark RSS 摘要 chip-huyen 2026-08-25 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
适配知识图谱以用于序列推荐中的行为去噪 — 序列推荐从用户交互历史中预测下一项,但并非每次交互都具有同等信息量。真实日志混合了持久偏好与…… LLM Agent 时代的图工程:从个体智能到系统智能 — LLM 已从语言生成器演变为能够处理复杂、长周期任务的能力。这一演进催生了从 Prompt Engineering 到…
Jay RSS 摘要 cool-papers-ir 2026-08-25 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
Move by Move:衡量并引导 LLM 进行心理治疗的方式 — 用户越来越多地转向大语言模型寻求情感支持,但这些模型究竟如何开展心理治疗交互仍知之甚少。本文提出一种 on… PromptModel Interaction Reaches the Fixed Points:一种确定性的、无任务依赖的结构读数——及其…
Jay RSS 摘要 cool-papers 2026-08-25 10:02
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为能够在…方面超越人类的系统 谨慎看待缩放定律 — 缩放定律是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $L$ 会可预测地下降… 我们为何思考…
Jay RSS 摘要 lilian-weng 2026-08-25 10:02
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家获取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这不是一个蒸馏故事。 我写了一本 AI 教科书——AI 多久才能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我…
flyP RSS 摘要 interconnects 2026-08-25 10:02
Gradient Flow · RSS 摘要
AI 数据中心的反对浪潮存在盲区 — 在我自己的社交圈中,我较早地指出了对 AI 数据中心日益增长的本地反对声音。此后,事态发展迅速,从零散的分区之争演变为全面禁令…… 最大的 AI 风险存在于模型之外 — 当前最具揭示性的 AI 失败案例并非关于模型变得过于强大,而是关乎模型周围的一切。某个系统获得了超出预期的访问权…
Spark RSS 摘要 gradient-flow 2026-08-25 10:01
Simon Willison · RSS 摘要
llmanthropic 0.27 — 发布:llmanthropic 0.27。该版本主要为 LLM 的 Anthropic 插件提供与近期发布的 anthropic v1.0.0 Python 库的兼容性…… 你的可执行文件就是一个 SQLite 数据库 — 你的可执行文件就是一个 SQLite 数据库。Farid…
Jay RSS 摘要 simon-willison 2026-08-25 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁获得 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁在掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 关系重置、中国开源权重模型实现代码能力对等、Agent 接入真实市场,以及 …
Jay RSS 摘要 nathan-benaich 2026-08-25 10:00
ByteByteGo · RSS 摘要
为什么在 AI 时代代码验证比以往任何时候都更重要 — 在本文中,我们将探讨代码验证的工作原理、AI 生成代码的兴起为何对其施加更大压力,以及 Andrea 关于 w… 的宝贵见解 EP223:Ollama vs vLLM vs SGLang — 要在本地运行开源权重模型,你有三个主要选择:Ollama、vLLM 和 …
Jay RSS 摘要 bytebytego 2026-08-25 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
Claude 如何为 AI 生成文本添加水印 — 48 分钟视频讲解 token 采样、水印检测与移除 从零构建 AI 文本检测器 — 端到端项目:包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源…
Jay RSS 摘要 raschka 2026-08-25 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
面向 LLM 的强化学习:完整指南 — 从第一性原理出发,梳理强化学习演化至现代 AI 研究前沿的全脉络... Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM... Agent 世界模型 — 教会语言 Agent 建模其环境,从而构建更强的语言 Agent... Ag…
flyP RSS 摘要 cameron-wolfe 2026-08-25 10:00
Fireship (YouTube) · RSS 摘要
DeepSeek 重返战场... 硅谷为之震颤 这个夏天,数学领域沦陷于机器... 这家新创公司可查询你的一切足迹... Meta 新模型想要"深度访问"你的个人生活... 我在 MIT 待了三天... 机器人炒作比你想象的更甚
Jay RSS 摘要 yt-fireship 2026-08-24 10:04
AI Explained (YouTube) · RSS 摘要
AI 正在变得有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封锁 —— 关于下一步的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-24 10:04
Lex Fridman (YouTube) · RSS 摘要
Khabib Nurmagomedov:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman Podcast #500 Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Le…
Tom RSS 摘要 yt-lex-fridman 2026-08-24 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动的 mansplainer(男性说教式讲解系统) 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-24 10:04
3Blue1Brown (YouTube) · RSS 摘要
跳钉谜题 64 块方糖谜题 但什么是交叉熵?| 压缩即智能(第二部分) 100 条随机弦,多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-08-24 10:04
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入探究像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Jay RSS 摘要 yt-karpathy 2026-08-24 10:03
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 越过红线 DeepMind 改写 AI 视觉认知方式 十亿美元级 AI 竞赛格局崩塌
flyP RSS 摘要 yt-two-minute-papers 2026-08-24 10:03
Microsoft Research Blog · RSS 摘要
扩展 Skala 的访问渠道,为预测性 DFT 提供了更快速的路径 — 微软研究院发布的更新版深度学习交换关联泛函 Skala 1.1,在计算化学领域提供了更高精度和更广泛的适用性…… MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立…
Jay RSS 摘要 msr-blog 2026-08-24 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿在于开发有能力的自主研究员 Import AI 468:23 个 RSI 构想;PostTrainBench+;以及信任与透明如何与 AI 竞赛交织 — 你将选择哪个星系? Import AI 467:可…
Jay RSS 摘要 import-ai 2026-08-24 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一份简短的笔记,列举了一些最常见陷阱的示例…… Agent(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artificial Int…
Spark RSS 摘要 chip-huyen 2026-08-24 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 BrowseCompPlus 投影到 ClimbMix:迈向更真实的 Agentic Search 语料库 — BrowseCompPlus benchmark 通过将不透明的 web search 替换为固定语料库,拆解了 agentic search 的评估,从而能够将 Agent 的角色与检索器分开…… 什么…
Jay RSS 摘要 cool-papers-ir 2026-08-24 10:01