Notes

笔记

浏览全部笔记 · 1033 篇

ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细介绍读路径与写路径的操作与技术。 大模型如何教小模型变聪明 — 本文将从基础开始,逐步讲解这一思路。 LLM 的记忆为何变得昂贵以及如何解决 — 本文将了解 LLM 如何使用记忆、为何会变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文试图构建一张完整的攻击面地图…
Jay RSS 摘要 bytebytego 2026-08-10 10:00
Simon Willison · RSS 摘要
引用 Claude Opus 5 系统提示 — Claude Fable 5 与 Claude Mythos 5 首次发布于 2026 年 6 月 9 日。2026 年 6 月 12 日,Anthropic 暂停了对这两个模型的访问,以遵守美国商务部…… GitHub Models 现已停用 — GitHub Mode…
Jay RSS 摘要 simon-willison 2026-08-10 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教导语言 Agent 对其环境建模,构建更优的语言 Agent... 智能体强化学习:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的强化学习 Scaling Laws —…
flyP RSS 摘要 cameron-wolfe 2026-08-10 10:00
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗……? 历史上最有趣的"hack"…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家估值 120 亿美元的初创公司终于发布了产品……
Jay RSS 摘要 yt-fireship 2026-08-09 10:03
Two Minute Papers (YouTube) · RSS 摘要
DeepMind刚刚改变了AI看世界的方式 价值十亿美元的AI竞赛格局已被打破 下一个DeepSeek时刻已经到来 NVIDIA的AI领悟到:模仿人类远远不够 Kimi K3刚刚打破了AI的经济逻辑
flyP RSS 摘要 yt-two-minute-papers 2026-08-09 10:03
AI Explained (YouTube) · RSS 摘要
AI 开始有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对战 GPT 5.6 Sol:早期结果 Claude Fable 被封锁——关于下一步的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-09 10:03
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman Podcast #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman Podcast #498 物理学最大谜团:反物质、暗能量与万物理论 — Don Lincoln | Lex Fridman Podcast #4…
Tom RSS 摘要 yt-lex-fridman 2026-08-09 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-09 10:03
3Blue1Brown (YouTube) · RSS 摘要
64 颗方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,会有多少个交点? 测量英语的熵 什么是完美编码?你如何得知?
Spark RSS 摘要 yt-3blue1brown 2026-08-09 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;调控 AI 进展节奏;对 AI 与创造力的混淆 — 我们何时建造月球 arcology? Import AI 466:机器人领域的苦涩教训,AI 完成长达一周的编程任务;以及 OpenAI 意外造就的 AI 黑客 — 警示将持续,直到文明觉醒 Import AI 46…
Jay RSS 摘要 import-ai 2026-08-09 10:02
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入了解像 ChatGPT 这样的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] Large Language Models 介绍](
Jay RSS 摘要 yt-karpathy 2026-08-09 10:02
Microsoft Research Blog · RSS 摘要
Orchard:面向可扩展 Agentic AI 的开放框架 — Orchard 是一个开源框架,供研究社区在多种任务类型上训练和评估 AI Agent。它在降低复杂度的同时,仍能支持小模型实现强大性能…… Echoverse:面向计算机使用 Agent 的深度且持续演进的环境 — 计算机使用型 AI Agent 在邮…
Jay RSS 摘要 msr-blog 2026-08-09 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
通过选择性上下文偏好优化学习何时信任 — 语言模型越来越多地依据外部信号来调整其回答,而单一误导性信号就可能把正确答案变为错误。显而易见的解决方案是训练模型抵御误… 工具调用的苦涩教训 — 工具使用使 LLM 转变为能在训练数据之外行动的 Agent,对于具备代码能力的模型,程序化工具调用通过用灵活的代码取代僵化的 J…
Jay RSS 摘要 cool-papers 2026-08-09 10:01
Cool Papers · cs.IR (papers.cool) · RSS 摘要
Gryphonv2:替代级联的单模型 — 带有 Rollout Distillation 的生成与排序推荐器 — 工业推荐系统通常以多阶段级联方式部署,包含独立的候选生成器、预排序器和最终排序器。虽然有效,但这些级联…… 个性化模态加权真的个性化吗?多模态推荐器中逐用户加权声明的受控审计 — 在多模态推荐器中,逐用户模…
Jay RSS 摘要 cool-papers-ir 2026-08-09 10:01
Lilian Weng (Lil'Log) · RSS 摘要
针对自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他在其中将"超智能机器"定义为一种能够在…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其形式简洁:随着模型规模扩大,训练损失 L 可预测地下降……
Jay RSS 摘要 lilian-weng 2026-08-09 10:01
Interconnects (Nathan Lambert) · RSS 摘要
推出 Artifacts Hub 与 Adoption Dashboard — 扩展对开放生态的策展与衡量 最新开放 artifacts(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了开放模型在帕累托前沿上的实用价值 — 训练强模型的能力正在扩散 开放模型回顾:更多关于 Kimi K…
flyP RSS 摘要 interconnects 2026-08-09 10:01
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agents — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellige…
Spark RSS 摘要 chip-huyen 2026-08-09 10:01
Gradient Flow · RSS 摘要
语言模型之后是什么 — Tom Zahavy 的一篇最新立场论文挑战了将科学发现视为足够宏大的预测或数据压缩问题的观点…… 通过评估并不意味着系统是安全的 — 评估是每个关于将 AI 投入生产的严肃讨论中不可或缺的一部分。团队定义基准、设定阈值,并越来越多地运行红队测试来观察系统的表现…… Workday、OpenAI…
Spark RSS 摘要 gradient-flow 2026-08-09 10:01
Simon Willison · RSS 摘要
Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。 — Auto 模式现已成为 Claude Code 在 Pro、Max 和 Team 套餐中的默认设置。Anthropic 对 Claude Code 的 Auto 模式非常有信心,甚至将其设为默认…… 现在我们掌握了…
Jay RSS 摘要 simon-willison 2026-08-09 10:00
ByteByteGo · RSS 摘要
读取路径与写入路径:策略与技术 — 本文将详细探讨读取路径与写入路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从零开始逐步剖析这一思路。 LLM 内存为何变得昂贵及修复方法 — 本文将介绍 LLM 如何使用内存、内存为何变得昂贵以及如何解决。 LLM 安全基础:完整的威胁模型 — 本文尝试勾勒出威胁 LLM…
Jay RSS 摘要 bytebytego 2026-08-09 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-09 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全门槛、微软与 OpenAI 重置、中国开源权重模型编码能力对标、Agent 走进真实市场,以及 OpenAI 获 1220 …
Jay RSS 摘要 nathan-benaich 2026-08-09 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — 通过让语言 Agent 对环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以应对复杂环境中的长程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 …
flyP RSS 摘要 cameron-wolfe 2026-08-09 10:00
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入剖析类似 ChatGPT 的 LLMs 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-08 10:03
Fireship (YouTube) · RSS 摘要
最安全的比特币存储方式刚刚被攻破…… Anthropic 刚刚杀死了独立开发者吗? 史上最有趣的“黑客事件”…… 开源权重 AI 参数量刚刚突破 2.8 万亿…… 这家估值 120 亿美元的初创公司终于交付了产品……
Jay RSS 摘要 yt-fireship 2026-08-08 10:03
Two Minute Papers (YouTube) · RSS 摘要
DeepMind刚刚改变了AI看世界的方式 价值十亿美元的AI竞赛格局被打破 第二个DeepSeek时刻已经到来 NVIDIA的AI领悟到单纯模仿人类远远不够 Kimi K3刚刚打破了AI的经济学
flyP RSS 摘要 yt-two-minute-papers 2026-08-08 10:03
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,摒弃炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个细节
flyP RSS 摘要 yt-ai-explained 2026-08-08 10:03
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动男性说教器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-08 10:03
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物之理 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频背…
Tom RSS 摘要 yt-lex-fridman 2026-08-08 10:03
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 但什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何得知?
Spark RSS 摘要 yt-3blue1brown 2026-08-08 10:03