flyP
浏览全部笔记 · 196 篇 · 多模态 · 精读 · 批判审稿
Interconnects (Nathan Lambert) · RSS 摘要
开放模型回顾:Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源与闭源的差距,以及下一步走向 — 与 Florian Brand 的播客对话 Kimi K3:开放权重的进一步升级 — 对全球 AI 生态的影响 开放模型的 6 个月生存期 — 开源 AI 可行性迄今为止最严峻的考验正在发生 最新开放 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务 Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的 RL 缩放定律 — 缩放定律如何从预训练演进到…
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 绝对疯狂的 AI 速度优化技巧 他们说这永远无法实时运行
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件实录,去除炒作 模型井喷:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5 全 319 页完整拆…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型综述:更多关于 Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源闭源差距以及未来走向 — 与 Florian Brand 的播客。 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球影响。 开源模型的 6 个月生死期 — 开源 AI 可行性迄今最严峻的考验正在上演。 最新开源产物…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic World Models — 通过教语言智能体建模其环境来创建更好的语言智能体…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… 智能体评估:详尽指南 — 有效评估 AI 智能体的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个低调细节 Claude Fable 5 完整 319 页深度拆解
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了一个本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这东西永远无法实时运行
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi 的 WAIC 演讲、蒸馏、开源与闭源的差距,以及下一步展望 — 与 Florian Brand 的播客节目 Kimi K3:开源权重的升级 — 对 AI 生态系统的全球性影响 开源模型的 6 个月生存期 — 开源 AI 生存能力迄今为止最严峻的考验正在发生…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言 Agent 对环境建模来构建更优的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长程任务... Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的 RL 缩放定律 — 缩放定律如何从预…
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步走向的 11 个低调细节 Claude Fable 5——完整 319 页拆…
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远不会实时运行
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、习近平 WAIC 讲话、蒸馏、开闭源差距以及下一步动向 — 与 Florian Brand 的播客对谈。 Kimi K3:开源权重的升级 — 对全球 AI 生态的影响。 开源模型只剩 6 个月生存期 — 开源 AI 可行性正面临迄今为止最严峻的考验。 最新开源产…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教语言 Agent 建模其环境来创建更好的语言 Agent…… 智能体强化学习:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习 Scaling Laws — Scal…
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远无法实时运行
AI Explained (YouTube) · RSS 摘要
模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对战 GPT 5.6 Sol:早期结果 Claude Fable 被封禁——下一步的 11 个隐藏细节 Claude Fable 5——完整 319 页详解 新版 Claude Opus 4.8:你可能错过的 15 …
Interconnects (Nathan Lambert) · RSS 摘要
Kimi K3:开放权重模型的又一次升级 — 对全球 AI 生态的影响 开放模型仅剩 6 个月生存窗口 — 开源 AI 可行性迄今为止最严峻的考验正在此刻上演 最新开放成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态的评估以及发布模型背后的动机 GLM5.2 是…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言 Agent 建模其环境来构建更优的语言智能体…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详尽指南 — 高效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
AI Explained (YouTube) · RSS 摘要
模型井喷:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5——319 页完整拆解 新版 Claude Opus 4.8:你可能错过的 15 …
Two Minute Papers (YouTube) · RSS 摘要
Claude刚刚揭示了AI最大的问题 Anthropic发现了一个本不该存在的东西 Minecraft只差一个绝妙的创意 DeepSeek绝对疯狂的AI速度优化技巧 他们说这永远无法实时运行
Interconnects (Nathan Lambert) · RSS 摘要
Kimi K3:开源权重的升级 — 对 AI 生态系统的全球性影响 开源模型的 6 个月生存期 — 开源 AI 可行性迄今最严峻的考验正在发生 最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态广度 — 对开源生态的评估以及发布模型背后的动机 GLM5.2:开源 Agent 的…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言智能体建模其环境来构建更好的语言智能体 智能体强化学习:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长视野任务 智能体评估:详细指南 — 有效评估 AI 智能体的最佳实践与常见模式 LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进到强化学习 LLM 基准测试解析 — 构…
AI Explained (YouTube) · RSS 摘要
模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封锁——关于下一步的 11 个低调细节 Claude Fable 5——全 319 页详解 新版 Claude Opus 4.8:你可能错过的 15…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型只剩 6 个月寿命 — 迄今为止对开源 AI 生存能力最严峻的考验正在发生。 最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进步 — 我一直在密切观察的一项能力阈值…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长时程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习…… LLM Benchmark 的结构剖析 — 用于构建最有效 LLM …
AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于下一步的 11 个隐藏细节 Claude Fable 5——完整 319 页拆解 新版 Claude Opus 4.8:你可能错过的 15…
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了一个本不应存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧 他们说这永远无法实时运行
Interconnects (Nathan Lambert) · RSS 摘要
开放模型还有 6 个月的生命周期 — 迄今为止对开源 AI 可行性最严峻的考验正在发生。 最新开源制品(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开源生态的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进展 — 一个我一直在密切关注的能力阈值。 …
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM Benchmark 的构成剖…
Two Minute Papers (YouTube) · RSS 摘要
Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的想法 DeepSeek 极其疯狂的 AI 速度优化技巧 他们说这永远无法实时运行