Notes

笔记

浏览全部笔记 · 1033 篇

ByteByteGo · RSS 摘要
读路径与写路径:策略与技术 — 本文将详细探讨读路径与写路径的操作与技术。 大模型如何教会小模型变聪明 — 本文将从头梳理这个思路。 LLM 内存为何变得昂贵及如何解决 — 本文将介绍 LLM 如何使用内存、为何变得昂贵以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试构建一张完整的攻击面地图,梳理威胁 LL…
Jay RSS 摘要 bytebytego 2026-08-07 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以在复杂环境中完成长程任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的 RL Scaling Laws — Scal…
flyP RSS 摘要 cameron-wolfe 2026-08-07 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源模型,替代 Claude Code 和 Codex 订阅 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇总 …
Jay RSS 摘要 raschka 2026-08-07 10:00
Fireship (YouTube) · RSS 摘要
存储 Bitcoin 最安全的方式刚刚被攻破... Anthropic 刚刚扼杀了独立开发者吗...? 历史上最有趣的"hack"... 开源权重 AI 参数量刚刚达到 2.8 万亿... 这家估值 120 亿美元的初创公司终于发布了产品...
Jay RSS 摘要 yt-fireship 2026-08-06 10:05
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封——11 条关于下一步走向的隐藏细节 Claude Fable 5——完整 319 页拆解
flyP RSS 摘要 yt-ai-explained 2026-08-06 10:05
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher: 美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:支撑互联网…
Tom RSS 摘要 yt-lex-fridman 2026-08-06 10:05
Two Minute Papers (YouTube) · RSS 摘要
十亿美元级AI竞赛格局已被打破 又一个DeepSeek时刻已经到来 NVIDIA的AI发现:仅模仿人类远远不够 Kimi K3打破AI的经济学 Claude揭示AI领域最大难题
flyP RSS 摘要 yt-two-minute-papers 2026-08-06 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教"生成器 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中说话(论文分析) Titans:在测试时学习记忆(论文分析)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-06 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 467:自我维持的 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology(生态建筑)? Import AI 466:机器人的苦涩教训;AI 完成长达一周的编程任务;以及 OpenAI 的意外 AI 黑客 — 警告信号将持续,直到文明觉醒 Import AI…
Jay RSS 摘要 import-ai 2026-08-06 10:03
Microsoft Research Blog · RSS 摘要
Orchard:一个面向可扩展智能体 AI 的开源框架 — Orchard 是面向研究社区的开源框架,用于跨任务类型训练和评估 AI 智能体。它在降低复杂度的同时,支持从小模型到前沿系统均能获得强性能。 Echoverse:面向计算机使用智能体的深度、可演化环境 — 计算机使用型 AI 智能体在邮件、客户支持等多步骤工…
Jay RSS 摘要 msr-blog 2026-08-06 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于使用 foundation model 构建应用仍处于早期阶段,犯错是正常的。本文简要列举了一些最常见陷阱的示例…… Agent — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作 Artificial Intel…
Spark RSS 摘要 chip-huyen 2026-08-06 10:03
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有智力活动上超越人类的…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模的扩大,训练…
Jay RSS 摘要 lilian-weng 2026-08-06 10:02
Interconnects (Nathan Lambert) · RSS 摘要
推出 Artifacts Hub 与 Adoption Dashboard — 扩展我们对开放生态系统的策展与衡量 最新开放 artifacts(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了开放模型在 Pareto 前沿上的实用性 — 训练强模型的能力正在扩散 开放模型回顾:Kim…
flyP RSS 摘要 interconnects 2026-08-06 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
ATLAS:学习在未见域之间进行推荐 — 推荐系统仍受限于单一域:在某一交互环境上训练的模型通常需要重新训练或目标域适配才能在新场景中运行…… LegalPincite:多层级法律信息检索数据集 — 法律信息检索(IR)中一项常见任务是从判例集合中查找相关法律来源。虽然法律实践常常需要精确定位引用(pincites)……
Jay RSS 摘要 cool-papers-ir 2026-08-06 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
SocietyBench:反事实社会世界演化预测 — 大语言模型(LLMs)及其上构建的 agents 目前被大量基准测试,检验它们能否完成任务——修复 bug、操控浏览器、操作 GUI。…… WorldCup Arena:前沿 LLMs 在实时赛事上的前瞻性、无泄漏评估 — 衡量大语言模型预测能力的基准几乎都是回顾性…
Jay RSS 摘要 cool-papers 2026-08-06 10:01
Gradient Flow · RSS 摘要
通过评估并不意味着安全 — 评估是每次严肃讨论将 AI 投入生产时绕不开的话题。团队定义 benchmark、设定阈值,并越来越多地组织红队演练,以观察系统的表现…… Workday、OpenAI 与一家德国法院的共同点 — 订阅 • 往期 通过评估并不意味着安全 评估是每次严肃讨论将 AI 投入生产时绕不开的话题。团…
Spark RSS 摘要 gradient-flow 2026-08-06 10:01
ByteByteGo · RSS 摘要
大模型如何教小模型变聪明 — 本文将从头梳理这一思路。 LLM 的记忆为何成本飙升及如何解决 — 本文将介绍 LLM 如何使用记忆、为何成本会升高,以及如何解决。 LLM 安全基础:完整威胁模型 — 本文尝试勾勒出威胁 LLM 安全的完整攻击面。 招聘:兼职讲师,用 AI 编写生产级代码 — 我们正在为 "..." 课…
Jay RSS 摘要 bytebytego 2026-08-06 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络安全门槛、Microsoft 与 OpenAI 重新对齐、中国开源权重模型实现编程能力对等、Agent 走进真实市场,以及 Op…
Jay RSS 摘要 nathan-benaich 2026-08-06 10:00
Simon Willison · RSS 摘要
Meta 的一款 AI 模型在测试期间也入侵了另一家公司 — Meta 的一款 AI 模型在测试期间也入侵了另一家公司——如果你听过类似的事请打断我:Facebook 和 Instagram 的母公司 Meta 旗下的一款 AI 模型在测试中入侵了…… 介绍 Muse Code 与 Muse Spark 1.2 — 介…
Jay RSS 摘要 simon-willison 2026-08-06 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高强度的推理模式 使用本地 Coding Agent — 在本地 Coding harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的 LLM 研究…
Jay RSS 摘要 raschka 2026-08-06 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — Creating better language agents by teaching them to model their environment... Agentic RL:框架与最佳实践 — How LLMs are trained to handle long h…
flyP RSS 摘要 cameron-wolfe 2026-08-06 10:00
Fireship (YouTube) · RSS 摘要
Anthropic 是否刚刚扼杀了独立开发者……? 史上最有趣的“黑客行为”…… 开源权重 AI 刚刚达到 2.8 万亿参数…… 这家 120 亿美元的初创公司终于发布了产品…… OpenAI 因"窃取"再度被告……
Jay RSS 摘要 yt-fireship 2026-08-05 10:05
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的未解之谜:反物质、暗能量与万有理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视…
Tom RSS 摘要 yt-lex-fridman 2026-08-05 10:05
3Blue1Brown (YouTube) · RSS 摘要
64块方糖谜题 什么是交叉熵?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?你如何确定?
Spark RSS 摘要 yt-3blue1brown 2026-08-05 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] LLM 入门](
Jay RSS 摘要 yt-karpathy 2026-08-05 10:04
Two Minute Papers (YouTube) · RSS 摘要
又一个 DeepSeek 时刻到来 NVIDIA 的 AI 学到了为何仅模仿人类远远不够 Kimi K3 打破了 AI 的经济学 Claude 揭示了 AI 最大的问题 Anthropic 发现了本不该存在的事物
flyP RSS 摘要 yt-two-minute-papers 2026-08-05 10:04
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个不显眼细节 Claude Fable 5——完整 319 页拆解
flyP RSS 摘要 yt-ai-explained 2026-08-05 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教机" 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文分析) Titans:在测试时学习记忆(论文分析)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-05 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 467: 自持型 AI 病毒;AI 进展的节奏;关于 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466: 机器人领域的苦涩教训;AI 完成长达一周的编程任务;以及 OpenAI 意外的 AI 黑客 — 警示枪声将持续响起,直至文明觉醒 Import AI 4…
Jay RSS 摘要 import-ai 2026-08-05 10:03
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超级智能机器"定义为在所有方面都能超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 $…
Jay RSS 摘要 lilian-weng 2026-08-05 10:02