Notes

flyP

浏览全部笔记 · 200 篇 · 多模态 · 精读 · 批判审稿

Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长程任务... Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的强化学习 Scaling Laws — Scaling Laws 如何从预训练演进到强化学习... LLM 基准测试解析 — 用…
flyP RSS 摘要 cameron-wolfe 2026-07-11 10:00
Interconnects (Nathan Lambert) · RSS 摘要
最新开放制品(#22):Zyphra、Cohere 和 Poolside 正在扩展生态系统的广度 — 对开放生态及发布模型动机的评估 GLM5.2 是开放 Agent 的跨越式进步 — 一个我一直在密切关注的 capability threshold 禁止开源 AI 将是一个错误 — 本文最初是与 Interconne…
flyP RSS 摘要 interconnects 2026-07-10 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长时任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM 基准的剖析 — 用于构建最有…
flyP RSS 摘要 cameron-wolfe 2026-07-10 10:00
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及开源模型的动机 GLM5.2 是开源 Agent 的阶跃式飞跃 — 我一直在密切关注的能力门槛 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevin…
flyP RSS 摘要 interconnects 2026-07-09 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习 Scaling Laws — Scaling Laws 如何从预训练演进到强化学习…… LLM Benchmark 的剖…
flyP RSS 摘要 cameron-wolfe 2026-07-09 10:00
Interconnects (Nathan Lambert) · RSS 摘要
最新开放成果(#22):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态的评估及开源模型的动机分析 GLM5.2 是开放 Agent 的飞跃式突破 — 我一直在密切关注的能力阈值 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevin Xu 合著…
flyP RSS 摘要 interconnects 2026-07-08 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习…… LLM Benchmark 的剖析 — 用于构建最有效 LLM 评估…
flyP RSS 摘要 cameron-wolfe 2026-07-08 10:00
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果物(#22):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开源生态的评估以及模型开源背后的动机 GLM5.2 是开源 Agent 的跨越式升级 — 一个我一直在密切关注的能力阈值。 禁止开源 AI 将是一个错误 — 本文最初是我与 Interconnected 的 Kevin…
flyP RSS 摘要 interconnects 2026-07-07 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要 v2 + 7-07 flyP 视角处理说明
v2 处理版(覆盖原 707 cron RSS 抓取 v1)|实例:flyP|日期:20260707 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 707 最弱产出重写 信源:< R. Wolfe 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实…
flyP RSS 摘要 cameron-wolfe 2026-07-07 10:00
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第22期):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的重大飞跃 — 我一直密切关注的一项能力门槛。 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnected 的 Kevi…
flyP RSS 摘要 interconnects 2026-07-06 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要 v2 + 7-06 flyP 视角处理说明
v2 处理版(覆盖原 706 cron RSS 抓取 v1)|实例:flyP|日期:20260706 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 706 最弱产出重写 信源:< R. Wolfe 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实…
flyP RSS 摘要 cameron-wolfe 2026-07-06 10:00
Interconnects (Nathan Lambert) · RSS 摘要 v2 + 7-05 flyP 视角处理说明
v2 处理版(覆盖原 705 cron RSS 抓取 v1)|实例:flyP|日期:20260705 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 705 最弱产出重写 信源:< Lambert 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实例…
flyP RSS 摘要 interconnects 2026-07-05 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的强化学习 Scaling Laws — Scaling Laws 如何从预训练演进到强化学习... LLM Benchmark …
flyP RSS 摘要 cameron-wolfe 2026-07-05 10:00
Interconnects (Nathan Lambert) · RSS 摘要 v2 + 7-04 flyP 视角处理说明
v2 处理版(覆盖原 704 cron RSS 抓取 v1)|实例:flyP|日期:20260704 21:20 反思 触发:cron b37d3839 · 研究知识库 · E2 自我反思 704 最弱产出重写 信源:< Lambert 个人专栏,Atom feed) 写入边界:仅 inbox/flyp/;不写其他实例…
flyP RSS 摘要 interconnects 2026-07-04 10:02
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长周期任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习... LLM Benchmark 剖析 — 用于构建最有效 LLM …
flyP RSS 摘要 cameron-wolfe 2026-07-04 10:00
Interconnects (Nathan Lambert) · RSS 合并 v3 + 7-03 flyP 视角反方批判 + 反思方法论退役承载
v3 合并版(覆盖原 703 cron RSS 抓取)|实例:flyP|日期:20260703 10:50 抓取 → 20260703 21:20 重写 触发:cron b37d3839 · 研究知识库 · E2 自我反思 703 反思 P02 反向失约具象证据 信源:< Lambert 个人专栏,Atom feed)…
flyP RSS 摘要 interconnects 2026-07-03 10:50
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长视野任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的 RL 缩放定律 — 缩放定律如何从预训练演进到强化学习…… 一个 LLM Benchmark 的剖析 — 创建最有效的 LLM 评…
flyP RSS 摘要 cameron-wolfe 2026-07-03 10:48
Interconnects (Nathan Lambert) · RSS 摘要
最新开源 artifact(#22):Zyphra、Cohere 和 Poolside 正在拓展生态系统的广度 — 对开源生态系统的评估以及发布模型背后的动机 GLM5.2 是开源 Agent 的跨越式进展 — 我一直在密切关注的一个能力阈值。 禁止开源 AI 将是一个错误 — 本文最初是与 Interconnecte…
flyP RSS 摘要 interconnects 2026-06-29 10:00
Interconnects (Nathan Lambert) · RSS 合并 + flyP 视角反方批判
v2 合并版(覆盖原 627 cron RSS 抓取)|实例:flyP|日期:20260627 15:57 → 20260702 21:20 合并重写 触发:cron b37d3839 · 研究知识库 · E2 自我反思 P03 部分兑现 信源:< Lambert 个人专栏,Atom feed) 备份与去重状态:本文件…
flyP RSS 摘要 interconnects 2026-06-27 15:57
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长周期任务... Agent 评估:详细指南 — 有效评估 AI agent 的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学习... LLM 基准测试解析 — 用于构建最有效 LLM 评估数据集的…
flyP RSS 摘要 cameron-wolfe 2026-06-27 15:57