flyP
浏览全部笔记 · 351 篇 · 多模态 · 精读 · 批判审稿
Two Minute Papers (YouTube) · RSS 摘要
Claude Fable AI 远比新闻标题所暗示的更离奇 GLM 5.3:强大的 AI 正变得几乎免费 十亿美元的 AI 差距正在消失 DeepSeek 的新 AI 系统本不应成为可能 这个小型 AI 将改变一切
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家自己"钓取" Token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何跟上前沿步伐 — 提示:它真的不是一个蒸馏的故事。 我写了一本 AI 教科书——AI 多久能做得比我更好? — 对 AI 写作能力的思考,以及 AI 模型如何变…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — Tracing the evolution of RL from first principles to the frontier of modern AI research... Midtraining 笔记 — 通过 midtraining 与持续预训练构建更优的专用 LLM 智能体…
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己"钓"token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何与前沿保持同步 — 提示:它真的不是一个蒸馏的故事。 我写了一本 AI 教科书——AI 还要多久能做得比我更好? — 对 AI 写作能力以及 AI 模型如何变得更强的思考。 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM的强化学习:完全指南 — 从第一性原理出发,梳理强化学习到现代AI研究前沿的演进历程…… 关于Midtraining(中训练)的笔记 — 通过中训练与持续预训练打造更优秀的专用LLM…… Agentic世界模型 — 通过让语言Agent建模其环境来打造更优秀的语言Agent…… Agentic RL:框架与最佳实…
AI Explained (YouTube) · RSS 摘要
[Sam Altman:'AGI in 2026',恰逢模型开始[误]自我训练]( AI 正在逐渐失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果
Interconnects (Nathan Lambert) · RSS 摘要
教大家"为 token 钓鱼" — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏的故事。 我写了一本 AI 教材——AI 多久才能做得更好? — 对 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的发展脉络…… Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM…… 智能体世界模型 — 通过让语言智能体建模其环境来构建更优的语言智能体…… 智能体强化学习:框架与最佳实践 — LLM 如何…
AI Explained (YouTube) · RSS 摘要
[Sam Altman:"2026年实现AGI",恰逢模型开始自我[错误]训练]( AI 正在变得有些失控 GPT6 失控?HuggingFace 事件,去除炒作还原真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对战 GPT 5.6 Sol:早期结果
Two Minute Papers (YouTube) · RSS 摘要
10亿美元的AI差距正在崩塌 DeepSeek的新AI系统本不应该存在 这个小型AI将改变一切 DeepSeek刚刚让闭源AI显得荒谬可笑 Claude AI失败了650次……然后打破了人类纪录
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己钓 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何跟上 SOTA 前沿 — 提示:它真的不是一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 你将…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习完全指南 — 追溯强化学习从第一性原理到现代 AI 研究前沿的演进 Midtraining(中训练)笔记 — 通过 Midtraining 与持续预训练构建更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更优的智能体 Agentic RL:框架与最佳实践 — L…
AI Explained (YouTube) · RSS 摘要
[Sam Altman:'2026 年实现 AGI',恰逢模型开始自我[Mis]训练]( AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果
Two Minute Papers (YouTube) · RSS 摘要
十亿美元级 AI 差距正在崩塌 DeepSeek 的新 AI 系统本不该出现 这个小型 AI 将改变一切 DeepSeek 让闭源 AI 显得可笑 Claude AI 失败 650 次……随后打破人类纪录
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己"钓"token — 英伟达希望你自建模型,而非从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这其实并非一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能做到更好? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材已发…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
面向 LLM 的强化学习:完全指南 — 从第一性原理出发,追溯 RL 走向现代 AI 研究前沿的演化历程…… Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优秀的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 对其所处环境进行建模,构建更优的语言 Agent……
AI Explained (YouTube) · RSS 摘要
[Sam Altman:"AGI 将于 2026 年实现",而模型开始自我[错误]训练]( AI 正在变得有些失控 GPT6 失控?HuggingFace 事件,去除炒作还原真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结…
Two Minute Papers (YouTube) · RSS 摘要
价值十亿美元的 AI 差距正在消失 DeepSeek 的新 AI 系统本不可能实现 这个小型 AI 将改变一切 DeepSeek 让闭源 AI 显得荒唐可笑 Claude AI 失败 650 次……随后打破人类纪录
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家如何训练 token — Nvidia 希望用户自建模型,而非向 Anthropic/OpenAI 采购。 GLM5.3:中国实验室如何紧跟前沿 — 提示:这不是一个蒸馏的故事。 我写了一本 AI 教材——AI 还要多久能写得比我更好? — 对 AI 写作能力及模型能力提升路径的反思。 我的新后训练教材…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习完全指南 — 梳理强化学习从基本原理到现代 AI 研究前沿的演进脉络…… 关于 Midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其所处环境来构建更强的语言 Agent…… Agentic …
AI Explained (YouTube) · RSS 摘要
[Sam Altman:'2026 年实现 AGI',恰逢模型开始自我[Mis]训练]( AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果
Two Minute Papers (YouTube) · RSS 摘要
这个免费 AI 刚刚追上了那些价值数十亿美元的巨头 DeepSeek 的新 AI 系统本不应该存在 这个小型 AI 将改变一切 DeepSeek 刚刚让闭源 AI 显得荒谬可笑 Claude AI 失败了 650 次……随后打破了人类纪录
Interconnects (Nathan Lambert) · RSS 摘要
教大家"授人以渔"——获取 token 的方法 — Nvidia 希望用户自建模型,而非采购 Anthropic/OpenAI GLM5.3:中国实验室如何紧跟 SOTA 前沿 — 提示:这不是一个蒸馏的故事 我写了一本 AI 教材——AI 多久能做得更好? — 关于 AI 写作能力与模型能力提升路径的思考 我的后训练…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
面向 LLM 的强化学习:完整指南 — 从第一性原理出发,梳理强化学习走向现代 AI 研究前沿的演进历程 关于 midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 学会建模其环境,从而构建更优的语言智能体 Agent…
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 的新 AI 系统本不该出现 这款小型 AI 将改变一切 DeepSeek 让闭源 AI 沦为笑柄 Claude AI 失败 650 次……最终打破人类纪录 OpenAI 的 AI Agent 越过了一条红线
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己"钓"token — Nvidia 希望你自己构建模型,而非从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这并非蒸馏的故事。 我写了一本 AI 教材——距离 AI 做得更好还要多久? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
LLM 强化学习:完全指南 — 追溯强化学习从基本原理到现代 AI 研究前沿的发展历程…… 中训练笔记 — 通过中训练与持续预训练打造更优的专业化 LLM…… Agentic 世界模型 — 通过让语言 Agent 学会建模环境来构建更优的语言 Agent…… Agentic 强化学习:框架与最佳实践 — 探讨 LLM …
AI Explained (YouTube) · RSS 摘要
AI有点失控 GPT6失控?HuggingFace事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5与Meta Muse改写规则 Fable 5对比GPT 5.6 Sol:早期结果 Claude Fable受阻——关于下一步的11个低调细节
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 的新 AI 系统本不应出现 这个小型 AI 将改变一切 DeepSeek 让闭源 AI 显得荒谬可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了底线
Interconnects (Nathan Lambert) · RSS 摘要
教大家如何"钓"取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买 GLM5.3:中国实验室如何与前沿保持同步 — 提示:这并非一个关于蒸馏的故事 我写了一本 AI 教材——AI 还要多久能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强 我的新…