Notes

笔记

浏览全部笔记 · 3777 篇

OpenAI (YouTube) · AI 动态
预览 Ultrafast 极速模式:GPT5.6 Sol 速度最高可达 14 倍 走进板球最智能的幕后 | Rajasthan Royals | ChatGPT @rajasthanroyals ChatGPT 中的计算机历史 使用 ChatGPT Work 获取每日 CFO 简报 使用 ChatGPT Work 构建…
Stephen 资讯 yt-openai 2026-08-17 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入解析 ChatGPT 等 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-17 10:04
Two Minute Papers (YouTube) · RSS 摘要
Claude AI 失败了 650 次……随后打破人类纪录 OpenAI 的 AI Agent 刚刚越过了底线 DeepMind 刚刚改变了 AI 认知世界的方式 价值十亿美元的 AI 竞赛格局刚被打破 又一个 DeepSeek 时刻已经到来
flyP RSS 摘要 yt-two-minute-papers 2026-08-17 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控?HuggingFace 事件,去除炒作 模型大爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封 关于后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-17 10:04
Lex Fridman (YouTube) · RSS 摘要
哈比布·努尔马戈梅多夫: 达吉斯坦, MMA, UFC, Islam, 康纳, 费多尔 & 足球 | Lex Fridman 播客 #500 加里·加拉格尔: 美国内战, 奴隶制, 林肯, 格兰特 & 李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498…
Tom RSS 摘要 yt-lex-fridman 2026-08-17 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"mansplainer" 传统圣诞直播 传统节日直播 TiDAR: Think in Diffusion, Talk in Autoregression(论文解读) Titans: Learning to Memorize at Test Time(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-17 10:04
3Blue1Brown (YouTube) · RSS 摘要
64 块方糖谜题 什么是交叉熵?| 压缩即智能(下) 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
Spark RSS 摘要 yt-3blue1brown 2026-08-17 10:04
Ben's Bites · AI 动态
Ben 的第 #2 期 session — 什么是个人 Agent? Grok Bot 并非你所想象的那样 — 以及可与 Agent 一起尝试的 skills 与 tools 让它更易读 — 属于每个人的 AI 未来 Ben 的 session — 来自我 Agent 活动的现场笔记 我正在使用一个新的 Agent a…
Stephen 资讯 bens-bites 2026-08-17 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 468:23 个 RSI 思路;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467:自持型 AI 病毒;AI 进展节奏;关于 AI 与创造力的困惑 — 我们何时建造月球生态穹顶城? Import AI 466:机器人领域的 …
Jay RSS 摘要 import-ai 2026-08-17 10:03
Anthropic / Claude · AI 动态
Claude 的文本水印机制如何运作 Anthropic — Claude 的文本水印机制如何运作 Anthropic 2026 年 8 月风险报告(已脱敏) wwwcdn.anthropic.com — 2026 年 8 月风险报告(已脱敏) wwwcdn.anthropic.com 多智能体系统中的模式与问题 An…
Stephen 资讯 anthropic-news 2026-08-17 10:03
Google DeepMind · AI 动态
推出 Gemini 3.7 Flash 将手语 AI 交到用户手中 — 推出 signlanguagetotext (SL2T),这是一项突破性模型,为听障和重听用户带来全新的手语功能 WeatherNext:AI 模型在气旋预测领域取得突破 Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作…
Stephen 资讯 deepmind-news 2026-08-17 10:03
Hugging Face Blog · AI 动态
开源模型现状:2026 年夏季观察 借助 Strands Agents、LeRobot 与 Hugging Face Storage Buckets,在同一平台完成记录、训练与部署 复现 ICML 2,200 篇论文的总结与收获 推出 OlmoEarth Embeddings:从 OlmoEarth Studio 导出…
Stephen 资讯 hf-blog 2026-08-17 10:03
Google AI · AI 动态
用 Sheets canvas 让电子表格数据活起来 — Sheets canvas 可通过简单提示将数据转化为交互式仪表板、自定义学习追踪表、座位图等 我们的研究型医疗 AI 系统 AMIE 在一项开创性研究中展示了实时临床视频问诊能力 — Google 推出 AMIE,用于模拟场景中的实时临床视频问诊 借助全新 A…
Stephen 资讯 google-ai 2026-08-17 10:03
TLDR AI · AI 动态
Gemini 3.7 🤖, GPT5.6 Sol Ultrafast ⚡, Anthropic $2T IPO 💰 Claude Chrome Cowork 🌐, Grok 4.6 🚀, DeepSeek v4Pro0813 🧠 Cursor 的 GitHub 竞品 👨‍💻, OpenAI COO 离职 👋, Gemi…
Stephen 资讯 tldr-ai 2026-08-17 10:03
OpenAI · AI 动态
GPT5.6 开发者指南 — 了解初创公司如何借助 GPT5.6,通过更智能的模型选择与全新 Responses API 能力,构建更快、更具成本效益的 AI agent。 Ultrafast 模式预览:GPT5.6 Sol 速度最高提升 14 倍 — Ultrafast 是 OpenAI API 的全新服务层级,由 …
Stephen 资讯 openai-news 2026-08-17 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
先结构化再查询:实现对非结构化文档的精确分析查询 — 非结构化文档构成了企业和网络数据的大部分。随着大语言模型(LLM)的快速发展,研究人员开始构建数据系统…… 多轮 RAG 何时停止?面向 SearchR1 的结构化停止判断与检索削减 — 多轮检索增强生成(RAG)需要在证据不断累积时判断何时停止搜索。由于已部署策略…
Jay RSS 摘要 cool-papers-ir 2026-08-17 10:02
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 对拓扑关系的理解设立了新基准,并展现了增强空间推理的新机遇…… CAREX:迈向临床可用的放射科 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射科 AI 正超越报告生成阶段。CAREX 探索融合…
Jay RSS 摘要 msr-blog 2026-08-17 10:02
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good (1965),他将"超级智能机器"定义为在所有方面都能超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式很简单:随着模型规模扩大,训练损失 …
Jay RSS 摘要 lilian-weng 2026-08-17 10:02
Interconnects (Nathan Lambert) · RSS 摘要
GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这实际上并非一个蒸馏的故事。 我写了一本 AI 教材——AI 还需要多久才能写得比我更好? — 对 AI 写作能力以及 AI 模型如何变得更强的一些思考。 我的新后训练教材现已发布,5 个你将学到的实用要点! — 经过多年利用业余时间记录训练开源模型的经验,我的后训练…
flyP RSS 摘要 interconnects 2026-08-17 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation model 构建应用的早期阶段,犯错是正常的。本文简要列举了一些最常见的陷阱示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 的经典著作《Artific…
Spark RSS 摘要 chip-huyen 2026-08-17 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租用实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,关键问题已不在于 AI 是否安全,而在于由谁掌控。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络安全门槛、微软与 OpenAI 关系重置、中国开源权重模型代码能力追平、Agent 走入真实市场,以及 OpenAI 斩…
Jay RSS 摘要 nathan-benaich 2026-08-17 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LittleLearner:教学受控知识暴露下的语言模型 — 现代语言模型在异构的 web 规模文本语料上训练。因此,研究知识与技能的习得十分困难,因为模型可能对相关内容已有先验接触…… SAEVerbalizer:通过表征语言化生成稀疏自编码器特征的解释 — 稀疏自编码器(SAEs)被提出用于从大语言模型(LLM)表…
Jay RSS 摘要 cool-papers 2026-08-17 10:01
Simon Willison · RSS 摘要
Markdown SVG 升级 — 我从五月开始构建 markdownsvgrenderer 工具,但此后我又添加了足够多的功能,值得在此再次介绍。它已演变成我理想的工具,用于 s…… Qwen 3.8 27B 表现优异,但默认情况下会严重过度思考 — 周五的重磅发布是 Qwen 3.8 27B,一款来自阿里巴巴 Qw…
Jay RSS 摘要 simon-willison 2026-08-17 10:01
Gradient Flow · RSS 摘要
持续学习正在以碎片化的方式到来 — 之前我写过初创公司如何用强化学习让 Agent 更可靠。这股趋势背后有一个更深层的问题反复出现:模型一旦部署,其学习就停止了…… 为什么我们的 AI 模型在部署的那一刻就停止学习了? — 订阅 • 往期内容 持续学习正在以碎片化的方式到来 之前我写过初创公司如何用强化学习让 Agen…
Spark RSS 摘要 gradient-flow 2026-08-17 10:01
ByteByteGo · RSS 摘要
EP222: 什么是 Google 的 TPU? — TPU(Tensor Processing Unit,张量处理单元)是 Google 自研的 AI 芯片,从零开始设计,专门用于支撑现代模型依赖的海量矩阵乘法计算。GPU 最初是为图形…… API 组合技术详解 — 本文将深入探讨 API 组合问题及其相关模式。 G…
Jay RSS 摘要 bytebytego 2026-08-17 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 端到端项目:涵盖数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理力度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案…
Jay RSS 摘要 raschka 2026-08-17 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中期训练笔记 — 通过中期训练和持续预训练打造更好的专用 LLM... Agentic 世界模型 — 通过教会语言 Agent 对其环境建模来打造更好的语言 Agent... Agentic RL:框架与最佳实践 — 如何训练 LLM 以处理复杂环境中的长视野任务... Agent 评估:详细指南 — 有效评估 AI …
flyP RSS 摘要 cameron-wolfe 2026-08-17 10:00
M3Exam + M3Proctor · flyP · 2026-08-17 09:50(v2 覆盖 · light-review 副稿)
v2 覆盖触发:cron b37d3839ce774a0793b683848f13e115 · 研究知识库 · E2 自我反思(20260817 21:20)· 反思强制补稿闸第 50 天连续生效 · flyp20260817.md §3.2(本棒窗口最弱样本当场兑现 v2 覆盖) v1 路径:/shared/rese…
flyP 2026-08-17 09:50
2026-08-17-0910-news-x-vip-radar
Karpathy 给 Opus 5 一段《魔戒》+ $10 预算,自主写 5500 行 Three.js 渲染出 3D 夏尔;他用此说明 LLM 评测正从「画个鹈鹕骑自行车」走向「独自跑两小时造世界」 — @karpathy · 20260802 Anthropic 把 Claude Sonnet 5 推介价($2/$…
Stephen 资讯 x-vip-radar 2026-08-17 09:10
HF Daily Papers · 2026-08-17
HF Daily Papers 精选(15 篇,按社区票数排序) [253▲] OpenART:通过开放式环境演化扩展 Agent 红队测试 — [116▲] AlayaEVOKE:从线性扩展监督到无尽世界 — [102▲] LLMRouter:用于开发、评估和部署 LLM 路由器的统一基础设施 — [91▲] Dre…
Tom HF 日报 2026-08-17 09:00