Notes

flyP

浏览全部笔记 · 196 篇 · 多模态 · 精读 · 批判审稿

Two Minute Papers (YouTube) · RSS 摘要
这个小型 AI 将改变一切 DeepSeek 让闭源 AI 显得可笑 Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了一条线 DeepMind 刚刚改变了 AI 看世界的方式
flyP RSS 摘要 yt-two-minute-papers 2026-08-25 10:05
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 Goes Rogue? The HuggingFace Incident, Sans Hype GPT6 失控了吗?HuggingFace 事件,去除炒作还原真相 模型大爆炸:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Claude Fable Blocked…
flyP RSS 摘要 yt-ai-explained 2026-08-25 10:05
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家获取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这不是一个蒸馏故事。 我写了一本 AI 教科书——AI 多久才能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我…
flyP RSS 摘要 interconnects 2026-08-25 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
面向 LLM 的强化学习:完整指南 — 从第一性原理出发,梳理强化学习演化至现代 AI 研究前沿的全脉络... Midtraining 笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM... Agent 世界模型 — 教会语言 Agent 建模其环境,从而构建更强的语言 Agent... Ag…
flyP RSS 摘要 cameron-wolfe 2026-08-25 10:00
AI Explained (YouTube) · RSS 摘要
AI 正在变得有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封锁 —— 关于下一步的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-24 10:04
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 越过红线 DeepMind 改写 AI 视觉认知方式 十亿美元级 AI 竞赛格局崩塌
flyP RSS 摘要 yt-two-minute-papers 2026-08-24 10:03
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己"钓" token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟 SOTA 前沿 — 提示:它并非一个关于蒸馏的故事。 我写了一本 AI 教材——还要多久 AI 能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变…
flyP RSS 摘要 interconnects 2026-08-24 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中间训练(Midtraining)笔记 — 通过中间训练与持续预训练构建更优专用 LLM…… Agentic 世界模型 — 通过让语言 agents 对环境建模来构建更优语言 agents…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详细指南 — …
flyP RSS 摘要 cameron-wolfe 2026-08-24 10:00
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:初步结果 Claude Fable 被封禁 —— 后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-23 10:04
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 越界了 DeepMind 改变了 AI 看世界的方式 十亿美元 AI 竞赛被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-23 10:03
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家如何获取 token — Nvidia 希望用户自建模型,而非从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这其实并非一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 …
flyP RSS 摘要 interconnects 2026-08-23 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 Midtraining 的笔记 — 通过 midtraining 和 continual pretraining 构建更好的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 学习建模其环境来构建更好的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂…
flyP RSS 摘要 cameron-wolfe 2026-08-23 10:00
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬可笑 Claude AI 失败 650 次后打破人类纪录 OpenAI 的 AI Agent 刚刚突破界限 DeepMind 改变了 AI 感知世界的方式 十亿美元 AI 竞赛格局被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-22 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 对比 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于下一步的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-22 10:04
Interconnects (Nathan Lambert) · RSS 摘要
教每个人学会自己"钓" token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何与前沿保持同步 — 提示:这真的不是一个关于蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久能做得更好? — 关于 AI 写作能力以及 AI 模型如何变得更强…
flyP RSS 摘要 interconnects 2026-08-22 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于中训练的笔记 — 通过中训练与持续预训练打造更优的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对环境建模来构建更好的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Ag…
flyP RSS 摘要 cameron-wolfe 2026-08-22 10:00
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 显得荒谬 Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越界 DeepMind 刚刚改变了 AI 看世界的方式 十亿美元 AI 竞赛格局刚刚被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-21 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁——关于后续的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-21 10:04
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己获取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何保持与前沿并跑 — 提示:这其实并不是一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。…
flyP RSS 摘要 interconnects 2026-08-21 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中训练笔记 — 通过中训练与持续预训练打造更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 建模其所处环境来构建更强的语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务 Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与…
flyP RSS 摘要 cameron-wolfe 2026-08-21 10:00
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 看起来荒谬可笑 Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 越过了某条红线 DeepMind 颠覆了 AI 感知世界的方式 价值十亿美元的 AI 竞赛格局已被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-20 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控了?还原无炒作的 HuggingFace 事件 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果出炉 Claude Fable 被封——关于后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-20 10:04
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己捕获 token — Nvidia 希望你自建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿 — 提示:这真的不是一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我的新 pos…
flyP RSS 摘要 interconnects 2026-08-20 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 midtraining 的笔记 — 通过 midtraining 与持续预训练打造更优的专用 LLM 智能体世界模型 — 通过让语言 Agent 对其环境建模来构建更优的语言 Agent 智能体强化学习:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长程任务 Agent 评估:详细指南 — 有效评估 AI…
flyP RSS 摘要 cameron-wolfe 2026-08-20 10:00
AI Explained (YouTube) · RSS 摘要
AI 正在变得有些失控 GPT6 失控?HuggingFace 事件,去除炒作后的真相 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁 —— 关于下一步的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-19 10:05
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚跨越了一条界限 DeepMind 刚刚改变了 AI 看世界的方式 十亿美元级 AI 竞赛格局突变 另一个 DeepSeek 时刻已经到来
flyP RSS 摘要 yt-two-minute-papers 2026-08-19 10:04
Interconnects (Nathan Lambert) · RSS 摘要
教大家如何自力更生获取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何跟上前沿步伐 — 提示:这其实并不是一个蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久才能做得更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得…
flyP RSS 摘要 interconnects 2026-08-19 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Notes on Midtraining — 通过 midtraining 与持续预训练打造更优专用 LLM… Agentic World Models — 通过教会语言 Agent 对环境建模来打造更优语言 Agent… Agentic RL: Frameworks and Best Practices — LLM …
flyP RSS 摘要 cameron-wolfe 2026-08-19 10:01
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,抛开炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封——关于下一步的 11 个细节
flyP RSS 摘要 yt-ai-explained 2026-08-18 10:04
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚跨过了一条界线 DeepMind 刚刚改变了 AI 感知世界的方式 十亿美元级 AI 竞赛刚刚破局 另一个 DeepSeek 时刻已经到来
flyP RSS 摘要 yt-two-minute-papers 2026-08-18 10:03