flyP
浏览全部笔记 · 196 篇 · 多模态 · 精读 · 批判审稿
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言智能体对其环境建模,从而构建更优的语言智能体... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... 智能体评估:详细指南 — 有效评估 AI 智能体的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁 关于下一步的 11 个细节 Claude Fable 5 319 页完整解析
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi's WAIC 演讲、蒸馏、开源与闭源差距的讨论,以及下一步展望 — 与 Florian Brand 的一期播客 Kimi K3:开放权重的升级 — 对 AI 生态系统的全球影响 开放模型的六个月生存期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长周期任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封——后续 11 个不为人知的细节 Claude Fable 5——完整 319 页拆解
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济模式 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了一个本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:关于 Kimi K3、Qwen 3.8、席 WAIC 演讲、蒸馏、开源闭源差距以及下一步的更多信息 — 与 Florian Brand 的播客对话 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球影响 开源模型的 6 个月生存期 — 开源 AI 生存能力的迄今最严峻考验正在上演 最新开源 ar…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 在复杂环境中训练以处理长 horizon 任务的方法…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scal…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,剔除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——319 页完整拆解
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的事物 Minecraft 一直缺少一个绝妙的创意 DeepSeek 堪称疯狂的 AI 加速技巧
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:深入探讨 Kimi K3、Qwen 3.8、习近平在 WAIC 的讲话、蒸馏技术、开源与闭源的差距,以及未来走向 — 与 Florian Brand 的播客对谈 Kimi K3:开源权重的全面升级 — 对全球 AI 生态的影响 开源模型的最后 6 个月 — 迄今为止对开源 AI 可行性最严峻的考验正在发生…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过教导语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长时序任务…… Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 缩放定律 — 缩放定…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件还原(去除炒作) 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果速览 Claude Fable 被封禁——11 个不为人知的下一步细节 Claude Fable 5——319 页完…
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚颠覆了 AI 的经济学 Claude 刚刚暴露了 AI 最大的问题 Anthropic 发现了一个本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi's WAIC 演讲、蒸馏、开源闭源差距及后续动态 — 与 Florian Brand 的播客对谈 Kimi K3:开放权重的升级 — 对全球 AI 生态的影响 开源模型的"六个月生存期" — 迄今为止对开源 AI 可行性最严峻的考验正在进行中 最新开源产出…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — Creating better language agents by teaching them to model their environment... Agentic RL:框架与最佳实践 — How LLMs are trained to handle long h…
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不应存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧 他们说这永远无法实时运行
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:初步结果 Claude Fable 被封禁——11 个关于下一步的隐藏细节 Claude Fable 5——319 页完整拆解
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、习在 WAIC 的演讲、蒸馏、开闭源差距,以及下一步动态 — 与 Florian Brand 的播客 Kimi K3:开源权重的升级加码 — 对 AI 生态系统的全球性影响 开源模型的 6 个月存亡期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 最新开…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — 通过教会语言 Agent 对其环境建模来构建更优的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何在训练中处理复杂环境下的长程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Sca…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封禁 关于后续走向的 11 个细节 Claude Fable 5 完整 319 页详解
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:Kimi K3、Qwen 3.8、习近平WAIC演讲、蒸馏、开源闭源差距及未来展望 — 与Florian Brand的播客对谈 Kimi K3:开源权重的升级 — 对AI生态系统的全球性影响 开源模型的6个月生存期 — 开源AI可行性迄今最严峻的考验正在进行 最新开源成果(第22期):Zyphra、Coh…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过让语言 Agent 对其环境建模来打造更优的语言 Agent… Agentic RL:框架与最佳实践 — 如何训练 LLM 以应对复杂环境中的长视野任务… Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式… LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封——关于下一步的 11 个低调细节 Claude Fable 5——完整 319 页详解
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 的最大问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 极其疯狂的 AI 加速技巧 他们说这个永远无法实时运行
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源闭源差距以及后续动向 — 与 Florian Brand 的一期播客 Kimi K3:开源权重的升级 — 对全球 AI 生态的影响 开源模型的 6 个月生存期 — 开源 AI 迄今为止最严峻的存亡考验正在发生 最新开源成果(第 22 期…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的强化学习 Scaling …
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个低调细节 Claude Fable 5——完整 319 页拆解
Two Minute Papers (YouTube) · RSS 摘要
Claude刚刚揭示了AI最大的问题 Anthropic发现了不应存在的东西 Minecraft缺少了一个绝妙的想法 DeepSeek极致的AI速度优化技巧 他们说这永远不会实时运行