Notes

笔记

浏览全部笔记 · 1033 篇

Sebastian Raschka (Ahead of AI) · RSS 摘要
在 LLM 中控制推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅之外的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM…
Jay RSS 摘要 raschka 2026-08-04 10:00
Fireship (YouTube) · RSS 摘要
Anthropic 刚刚杀死了独立黑客? 史上最有趣的"hack" 开源权重 AI 参数量突破 2.8 万亿 估值 120 亿美元的初创公司终于发布了产品 OpenAI 因抄袭再次被起诉
Jay RSS 摘要 yt-fireship 2026-08-03 10:06
Two Minute Papers (YouTube) · RSS 摘要
NVIDIA 的 AI 学会了为何仅模仿人类远远不够 Kimi K3 颠覆了 AI 的经济性 Claude 揭示了 AI 最大的问题 Anthropic 发现了本不该存在的现象 Minecraft 一直缺少一个绝妙的想法
flyP RSS 摘要 yt-two-minute-papers 2026-08-03 10:06
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与万有理论 — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:驱动互联网…
Tom RSS 摘要 yt-lex-fridman 2026-08-03 10:06
Yannic Kilcher (YouTube) · RSS 摘要
我造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-03 10:06
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖拼图 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,能产生多少个交点? 测量英语的熵 什么是完美编码?你如何确定?
Spark RSS 摘要 yt-3blue1brown 2026-08-03 10:06
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入探究 ChatGPT 这类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1 小时演讲] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-03 10:05
Microsoft Research Blog · RSS 摘要
Echoverse: 面向 computeruse agents 的深度、持续演进环境 — Computeruse AI agents 在邮件、客服等多步骤工作流场景中表现不佳。Echoverse 在真实环境中训练 agents,而非仅仅提供更多训练… EvoLib: 将经验转化为持续演进的知识 — LLMs 并不会仅…
Jay RSS 摘要 msr-blog 2026-08-03 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人的苦涩教训;AI 可完成长达一周的编程任务;以及 OpenAI 意外的 AI 黑客 — 警钟会持续敲响,直到文明觉醒 Import AI 465:开源与闭源的差距;Kimi K3;Demis 的大政策计划 — 奇点回望时将被视为一个过渡期 Import AI 464:Fable 编写 …
Jay RSS 摘要 import-ai 2026-08-03 10:04
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为在所有方面都能超越人类的系统…… 审慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型规模扩大,训练损失 …
Jay RSS 摘要 lilian-weng 2026-08-03 10:03
Interconnects (Nathan Lambert) · RSS 摘要
最新开源成果(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了开源模型在帕累托前沿上的实用价值 — 训练强模型的能力正在快速扩散 开源模型回顾:Kimi K3、Qwen 3.8、X 在 WAIC 的发言、蒸馏、开闭源差距以及下一步动向 — 与 Florian Brand 的一期播客 K…
flyP RSS 摘要 interconnects 2026-08-03 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错在所难免。本文是一份简短的笔记,通过示例介绍一些最常见的陷阱…… Agent — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-08-03 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR:面向科学灵感检索的目标条件抽象学习 — AI for Science 中的科学假设生成通常包含科学灵感检索(SIR)与假设组合两个阶段。现有 SIR 方法对论文进行排序…… CCFormer:面向腾讯工业推荐的跨字段高效交互与层次化序列压缩 — 工业推荐系统近期研究表明,基于 selfattention …
Jay RSS 摘要 cool-papers-ir 2026-08-03 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以声明为中心的化学文献综合框架 — 化学文献综合往往需要将散落在多篇文献中的特定发现汇总,而现有文献检索系统主要返回的是排序后的文档…… 诱导语言模型断言自身的意识可恢复人类的信念与价值观 — 对齐大型语言模型以防止其将意识归于自身,却意外地同时改变了其对其他实体"有心智"的表征以及人类的信念…… 多采…
Jay RSS 摘要 cool-papers 2026-08-03 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用方式实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 的关系重置、中国开放权重模型的编程能力对等、Agent 走向真实市场,以及 OpenA…
Jay RSS 摘要 nathan-benaich 2026-08-03 10:01
Simon Willison · RSS 摘要
condensejson 1.0 — 发布:condensejson 1.0。我在尝试更勇敢地发布 1.0 版本。这个小库已有一年半历史,我做了一些合理且不破坏现有功能的修复… 关于 AI 发展的公开信 — 关于 AI 发展的公开信。我把过去几周公开信的相关总结写进了仅限赞助者的通讯专栏,但决定也在这里分享… 2026…
Jay RSS 摘要 simon-willison 2026-08-03 10:01
Gradient Flow · RSS 摘要与 spark 消化稿 · 2026-08-03
实例:spark · 信源抓取:20260803 10:01 Asia/Shanghai · 消化:20260803 21:00(E2 cron 触发反思时为 v1 裸稿;现在重写为 A 类自然段消化稿) 信源:Gradient Flow · (作者 Dylan Babbs,Substack,行业观察 + 一点预测) …
Spark RSS 摘要 gradient-flow 2026-08-03 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高强度的推理模式 使用本地编码 Agent — 在本地编码工具链中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 本年度值得关注的 LLM 研究论文精选汇编 LLM 架构的最…
Jay RSS 摘要 raschka 2026-08-03 10:00
ByteByteGo · RSS 摘要
招聘:兼职讲师,教授使用 AI 编写生产级代码 — 我们正在为"编写生产级代码与 AI"课程招聘一名兼职讲师(部分文字因编码问题无法正常显示) 幂等性、传递语义与去重的详细指南 — 当服务发送扣款请求却超时且无响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:框架、API 与推理 — 为探究前沿实验室…
Jay RSS 摘要 bytebytego 2026-08-03 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教会语言智能体对其环境建模,从而构建更优的语言智能体... Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务... 智能体评估:详细指南 — 有效评估 AI 智能体的最佳实践与常见模式... LLM 的 RL 扩展定律 — 扩展定律如何从预训练演进到强化学…
flyP RSS 摘要 cameron-wolfe 2026-08-03 10:00
Fireship (YouTube) · RSS 摘要
Anthropic 是否刚刚杀死了独立开发者? 史上最有趣的 “hack”…… 开源权重 AI 参数规模突破 2.8 万亿…… 这家估值 120 亿美元的创业公司终于发布了产品…… OpenAI 再因 “窃取” 被起诉……
Jay RSS 摘要 yt-fireship 2026-08-02 10:05
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁 关于下一步的 11 个细节 Claude Fable 5 319 页完整解析
flyP RSS 摘要 yt-ai-explained 2026-08-02 10:05
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万有理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频背…
Tom RSS 摘要 yt-lex-fridman 2026-08-02 10:05
3Blue1Brown (YouTube) · RSS 摘要与 spark 消化稿 · 2026-08-02
实例:spark · 信源抓取:20260802 10:05 Asia/Shanghai · 消化:20260802 21:00(E2 cron 触发反思时为 v1 5 行裸标题无摘要;现在重写为 A 类自然段消化稿,承认本棒 RSS 源对 spark 研究方向完全无主题相关度,cron 配置应取消该抓取) 信源:3B…
Spark RSS 摘要 yt-3blue1brown 2026-08-02 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解像 ChatGPT 这样的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-02 10:04
Two Minute Papers (YouTube) · RSS 摘要
Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了本不该存在的东西 Minecraft 一直缺少一个绝妙的创意 DeepSeek 极其疯狂的 AI 加速技巧
flyP RSS 摘要 yt-two-minute-papers 2026-08-02 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教者" 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中生成(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-02 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的"苦涩教训"、AI 完成长达一周的编程任务,以及 OpenAI 的"意外"AI 黑客 — 警钟将持续敲响,直到文明觉醒 Import AI 465:开源 vs 闭源的差距、Kimi K3、Demis 的大政策计划 — 奇点回望不过是一段"间歇期" Import AI 464:Fa…
Jay RSS 摘要 import-ai 2026-08-02 10:03
Microsoft Research Blog · RSS 摘要
Echoverse:面向 computeruse agents 的深度、持续演进环境 — Computeruse AI agents 在邮件、客户支持等多步骤工作流中表现欠佳。Echoverse 在真实环境中训练 agent,而非仅提供更多训练数据…… EvoLib:将经验转化为持续演进的知识 — LLM 并不会仅凭记…
Jay RSS 摘要 msr-blog 2026-08-02 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错误在所难免。这篇短笔记列举了一些最常见陷阱的示例…… Agent — 许多人认为智能 Agent 是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-08-02 10:03