flyP
浏览全部笔记 · 196 篇 · 多模态 · 精读 · 批判审稿
Interconnects (Nathan Lambert) · RSS 摘要
教大家"为 token 而渔" — Nvidia 希望你自建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏(distillation)的故事。 我写了一本 AI 教科书——AI 多久能做得比我更好? — 关于 AI 写作能力的反思,以及 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Midtraining 笔记 — 借助 midtraining 与持续预训练打造更优专用 LLM Agentic World Models — 通过让语言 Agent 建模其环境,打造更优语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务 Agent 评估:详尽指…
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败了 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了底线 DeepMind 刚刚改变了 AI 认知世界的方式 价值十亿美元的 AI 竞赛格局刚被打破 又一个 DeepSeek 时刻已经到来
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于后续走向的 11 个低调细节
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这实际上并非一个蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久才能写得比我更好? — 对 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材现已发布,5 个你将学到的实用要点! — 经过多年利用业余时间记录训练开源模型的经验,我的后训练…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中期训练笔记 — 通过中期训练和持续预训练打造更好的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对其环境建模来打造更好的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务... Agent 评估:详细指南 — 有效评估 AI …
AI Explained (YouTube) · RSS 摘要
AI 有些失控了 GPT6 失控了?HuggingFace 事件,不带炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封锁 关于后续走向的 11 个低调细节
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了一条红线 DeepMind 刚刚改变了 AI 理解世界的方式 价值十亿美元的 AI 竞赛格局刚刚被打破 又一个 DeepSeek 时刻已经到来
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我的新后训练教材中你将学到的 5 个有用内容(即刻上线!) — 历经多年断断续续地记录训练开源模型的经验,后训练一书终于完成! 来…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练(Midtraining)的笔记 — 通过中训练与持续预训练打造更优的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 建模其所处环境,打造更优的语言 Agent…… Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务…… Agent 评估:详尽指南…
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败了 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了界限 DeepMind 刚刚改变了 AI 看待世界的方式 十亿美元的 AI 竞赛格局刚被打破 又一个 DeepSeek 时刻已经到来
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个细节
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏故事。 我写了一本 AI 教材——AI 还要多久能做得更好? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材已上线,5 个你将学到的实用要点 — 经过多年抽空整理训练开源模型的经验,我的后训练书终于完成! 来自实战…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 midtraining 的笔记 — 通过 midtraining 与持续预训练打造更好的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对其环境建模来构建更优的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... Age…
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作的解读 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 11 个关于下一步走向的低调细节
Two Minute Papers (YouTube) · RSS 摘要
OpenAI的AI Agent突破新界限 DeepMind改写AI视觉认知 十亿美元AI竞赛格局生变 又一个DeepSeek时刻来临 NVIDIA的AI明白:单纯模仿人类远远不够
Interconnects (Nathan Lambert) · RSS 摘要
我写了一本AI教科书——AI还需要多久才能写得比我更好? — 对AI写作能力的反思,以及AI模型如何变得更强。 你将在我的新posttraining教科书中学到的5个实用要点(即日上线!) — 历经数年抽时间整理我从训练开源模型中总结的经验,posttraining书终于完成! 来自hack的经验 — 关于模型alig…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中间训练(Midtraining)的笔记 — 通过中间训练与持续预训练打造更优的专用 LLM 智能体世界模型(Agentic World Models) — 通过让语言 Agent 对环境建模来构建更优的语言 Agent 智能体强化学习(Agentic RL):框架与最佳实践 — LLM 如何被训练以处理复杂环境中…
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 重塑规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封 11 个关于后续走向的低调细节
Two Minute Papers (YouTube) · RSS 摘要
OpenAI 的 AI Agent 刚刚越过了某条线 DeepMind 刚刚改变了 AI 理解世界的方式 十亿美元级 AI 竞赛迎来关键转折 又一个 "DeepSeek 时刻" 已经到来 NVIDIA 的 AI 领悟到:仅模仿人类远远不够
Interconnects (Nathan Lambert) · RSS 摘要
我写了一本 AI 教科书——AI 还要多久才能写得比我更好? — 关于 AI 写作能力以及 AI 模型如何持续变强的一些思考。 我新出的 posttraining 教科书(即日发布!)中你会学到的 5 个要点 — 历经数年挤出时间,终于把训练开源模型的经验整理成书——我的 posttraining 书完稿了! 来自 h…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中期训练的笔记 — 通过中期训练与持续预训练打造更优专用 LLM 智能体世界模型 — 通过让语言 Agent 建模其环境来构建更优的语言智能体 Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务 智能体评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM…
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对阵 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个不为人知的细节
Two Minute Papers (YouTube) · RSS 摘要
OpenAI 的 AI Agent 刚刚越线了 DeepMind 刚刚改变了 AI 感知世界的方式 十亿美元规模 AI 竞赛格局刚刚被打破 下一个 DeepSeek 时刻已经到来 NVIDIA 的 AI 学会了为何模仿人类远远不够
Interconnects (Nathan Lambert) · RSS 摘要
你将在我的新后训练教材(现已发布)中学会的5个有用内容 — 经过数年的点滴积累,我终于完成了训练开源模型的课后训练书 来自实战中的经验教训 — 关于模型对齐、安全性的决定因素以及未来走向的思考 推出 Artifacts Hub 与 Adoption Dashboard — 扩展我们对开源生态的策展与度量 最新开源 ar…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Midtraining 笔记 — 通过 midtraining 和 continual pretraining 创建更好的专用 LLM... Agentic 世界模型 — 通过教语言 Agent 对其环境建模来创建更好的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中…
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节
Two Minute Papers (YouTube) · RSS 摘要
DeepMind 刚刚改变了 AI 看世界的方式 价值十亿美元的 AI 竞赛格局已被打破 又一个 DeepSeek 时刻已经到来 NVIDIA 的 AI 学到了为何模仿人类远远不够 Kimi K3 刚刚打破了 AI 的经济学规律
Interconnects (Nathan Lambert) · RSS 摘要
我的新 posttraining 教科书中你将学到的 5 个要点(即日上线!) — 经过漫长数年的积累,我终于把训练开放模型的实战经验整理成书,posttraining 书完稿了! 实战踩坑经验总结 — 对模型对齐、安全的决定因素以及未来方向的思考 全新发布:Artifacts Hub 与 Adoption Dashb…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中训练笔记 — 通过中训练与持续预训练构建更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 建模环境来构建更优的语言 Agent Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长时域任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模…