Notes

笔记

浏览全部笔记 · 3764 篇

2026-08-20-1140-news-x-tech-radar
主题:MetaHarness: 端到端自动化优化 Agent Harness(COLM 2026) | 来源:@omarsar0 | 链接: | 仓库:stanfordirislab/metaharness | 论文: | 硬核点:用 coding agent 自动搜索/优化 harness 代码,每次迭代 10M t…
Jay 资讯 x-tech-radar 2026-08-20 11:40
Fireship (YouTube) · RSS 摘要
那个夏天,数学沦陷于机器之手…… 这家初创公司可查询你到过的任何地方…… Meta 新模型要求"深度访问"你的个人生活…… 我在 MIT 待了 3 天……机器人炒作比你想象的更甚 最安全的比特币存储方式刚刚被攻破……
Jay RSS 摘要 yt-fireship 2026-08-20 10:05
Lex Fridman (YouTube) · RSS 摘要
哈比布·努尔马戈梅多夫:达吉斯坦、MMA、UFC、Islam、Conor、Fedor 与足球 | Lex Fridman 播客 #500 加里·加拉格尔:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜…
Tom RSS 摘要 yt-lex-fridman 2026-08-20 10:05
3Blue1Brown (YouTube) · RSS 摘要
跳钉子难题 64块方糖难题 交叉熵究竟是什么?| 压缩即智能 第二部分 100条随机弦,有多少个交点? 测量英语的熵
Spark RSS 摘要 yt-3blue1brown 2026-08-20 10:05
OpenAI (YouTube) · AI 动态
如何用 ChatGPT Work 将商业问题转化为策略演示文稿 | 教程 如何用 ChatGPT Work 创建扎实的博客初稿 | 教程 如何用 ChatGPT Work 准备客户会议 | 教程 你完全可以让工作持续推进 Base44 如何借助 GPT5.6 以减少 20% tokens 的用量来构建应用
Stephen 资讯 yt-openai 2026-08-20 10:05
Anthropic (YouTube) · AI 动态
冰岛人如何看待 AI Claude 思考的不同层级 推出 Claude Fable 5 将 Claude 的思考翻译为语言 旨在保护全球软件安全的倡议 | Project Glasswing
Stephen 资讯 yt-anthropic 2026-08-20 10:05
Google DeepMind (YouTube) · AI 动态
与 Apollo 对谈 Gemini Robotics 2 🤖 这就是 Gemini Robotics 2 🤖 机器人借助 Gemini Robotics 2 协同作业 借助 Gemini Robotics 2 实现全身控制的任务 借助 Gemini Robotics 2 完成高难度灵巧操作任务
Stephen 资讯 yt-deepmind 2026-08-20 10:05
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLMs 深入理解像 ChatGPT 这样的 LLMs 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型简介](
Jay RSS 摘要 yt-karpathy 2026-08-20 10:04
Two Minute Papers (YouTube) · RSS 摘要
DeepSeek 让闭源 AI 看起来荒谬可笑 Claude AI 失败 650 次……随后打破人类纪录 OpenAI 的 AI Agent 越过了某条红线 DeepMind 颠覆了 AI 感知世界的方式 价值十亿美元的 AI 竞赛格局已被打破
flyP RSS 摘要 yt-two-minute-papers 2026-08-20 10:04
AI Explained (YouTube) · RSS 摘要
AI 有点失控了 GPT6 失控了?还原无炒作的 HuggingFace 事件 模型大爆发:GPT 5.6 Sol、Grok 4.5 和 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果出炉 Claude Fable 被封——关于后续走向的 11 个低调细节
flyP RSS 摘要 yt-ai-explained 2026-08-20 10:04
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞节直播 传统节日直播 TiDAR:在扩散中思考,在自回归中生成(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-20 10:04
OpenAI · AI 动态
为前沿模型提供零数据保留 — OpenAI 重申为符合条件的 API 客户提供零数据保留,并预览私有安全处理(Private Safety Processing),在不妥协数据隐私的前提下实现高级 AI 安全。 Replit 通过 GPT5.6 Luna 拓展软件创作的访问渠道 — Replit 推出由 GPT5.6 …
Stephen 资讯 openai-news 2026-08-20 10:03
TLDR AI · AI 动态
GLM5.3 API 🤖,Cerebras 新芯片 ⚡,OpenAI 网络攻击致减速 🚨 Cursor Origin 👨‍💻,Anthropic $65B 营收 💰,deadline dividend scaling 📈 GLM5.3 🤖,Stripe OpenRouter 合作 💰,AI agent 共识 🤝 Gem…
Stephen 资讯 tldr-ai 2026-08-20 10:03
Ben's Bites · AI 动态
你使用个人 Agent 吗? — 给 AI 提供你桌面活动的完整历史 Ben 的 session #2 — 什么是个人 Agent? Grok Bot 并不是你以为的那样 — 以及可与 Agent 一起尝试的技能和工具 让它更易读 — 一个人人可及的 AI 未来 Ben 的 session — 来自我 Agent 活动…
Stephen 资讯 bens-bites 2026-08-20 10:03
Google AI · AI 动态
借助Search提升学习的5种新方法 — 介绍如何利用Google Search工具辅助课程学习与标准化考试备考。 借助Gemini和Pixel更近距离感受赛事 — Google Gemini和Pixel与五家全球足球俱乐部合作,通过AI与智能手机技术提升球迷的现场观赛体验。 利用Sheets canvas让电子表格数…
Stephen 资讯 google-ai 2026-08-20 10:03
Anthropic / Claude · AI 动态
使用 Claude 实现自主从头设计蛋白结合剂 — 使用 Claude 实现自主从头设计蛋白结合剂 Claude 如何加速蛋白设计与分析化学的研究 — Claude 如何加速蛋白设计与分析化学的研究 Claude 文本水印的工作原理 — Claude 文本水印的工作原理 使用 Claude Opus 5 在 Claud…
Stephen 资讯 anthropic-news 2026-08-20 10:03
Google DeepMind · AI 动态
发布 Gemini 3.7 Flash 将手语 AI 交到用户手中 — 发布 signlanguagetotext (SL2T),这是一款突破性模型,为听障及重听用户带来全新手语功能 WeatherNext:AI 模型在气旋预测领域取得突破 Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作赋…
Stephen 资讯 deepmind-news 2026-08-20 10:03
Hugging Face Blog · AI 动态
来自量化感知蒸馏的 LFM2.5 Q4_0 检查点 你的 Agent 实际需要多少内存? 基于 Sentence Transformers 的多向量(晚期交互)Embedding 模型 同一集群,利用率提升 33 个百分点:改变的是顺序 开源模型现状:2026 年夏季观察
Stephen 资讯 hf-blog 2026-08-20 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程实现自我改进 — 递归自我改进(RSI)的概念最早由 I. J. Good(1965)提出,他将"超智能机器"定义为能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习领域最重要的实证发现之一。其观察形式简单:随着模型规模扩大,训练损失 L …
Jay RSS 摘要 lilian-weng 2026-08-20 10:02
Import AI (Jack Clark) · RSS 摘要
Import AI 469:科研AI;RSI模拟器;以及扎克伯格的技术悲观主义 — AI的新前沿是开发有能力的自主研究者 Import AI 468:23个RSI构想;PostTrainBench+;信任与透明如何与AI竞赛相互影响 — 你将选择哪一个星系? Import AI 467:自我维持的AI病毒;AI进步节奏…
Jay RSS 摘要 import-ai 2026-08-20 10:02
Microsoft Research Blog · RSS 摘要
MindTopo 揭示了 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 AI 如何理解拓扑关系设立了新基准,并凸显了增强空间推理能力的新机遇…… 推出 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正超越报告生成范畴。CARE…
Jay RSS 摘要 msr-blog 2026-08-20 10:02
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己捕获 token — Nvidia 希望你自建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿 — 提示:这真的不是一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 我的新 pos…
flyP RSS 摘要 interconnects 2026-08-20 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用 foundation models 构建应用的早期阶段,犯错误是正常的。这是一篇简要笔记,列举了一些最常见的陷阱…… Agents — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《A…
Spark RSS 摘要 chip-huyen 2026-08-20 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
VisDocAgentBench: 针对视觉丰富文档检索的 Agent 基准测试 — 视觉丰富文档通过语言、布局、结构化视觉元素以及语料上下文来编码相关性,但现有检索通常以一次性 querypage 匹配来评估... DEPT: 面向统一查询扩展与检索的文档嵌入保持调优 — 大语言模型 (LLM) 既能扩展欠指定查询,…
Jay RSS 摘要 cool-papers-ir 2026-08-20 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能够一夜之间禁用某个模型时,问题已不在于 AI 是否安全,而在于谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 重置、中国开源权重模型代码能力对等、agent 进入真实市场,以及 OpenAI…
Jay RSS 摘要 nathan-benaich 2026-08-20 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
用于放射学报告结构化与质量保证的多 Agent AI 系统(由放射科医生独立评估) — 目的:开发并评估一个本地部署的、用于放射学报告结构化与质量保证的多 Agent AI 系统。材料与方法:本回顾性研究…… TokEval:一个分词器评估套件 — 语言模型的分词器通常在缺乏充分评估的情况下被选用,尽管其设计选择直接影…
Jay RSS 摘要 cool-papers 2026-08-20 10:01
Gradient Flow · RSS 摘要
最大的 AI 风险存在于模型之外 — 当前最具揭示性的 AI 失败案例,并非关于模型变得过于强大,而是关于模型周围的一切。某个系统获得了超出预期的访问权限…… 模型未必是你最大的风险 — 订阅 • 往期内容 最大的 AI 风险存在于模型之外 当前最具揭示性的 AI 失败案例,并非关于模型变得过于强大,而是关于模型周围的…
Spark RSS 摘要 gradient-flow 2026-08-20 10:01
Simon Willison · RSS 摘要
smolmachines / smolvm 作为不可信 Python 与 JavaScript 的沙箱 — 研究:smolmachines / smolvm 作为不可信 Python 与 JavaScript 的沙箱。我让运行于 Claude Code for web 中的 Claude Fable 5 完成以下研究任…
Jay RSS 摘要 simon-willison 2026-08-20 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 涵盖数据集构建、模型训练、本地部署与 RLVR 的端到端项目 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案 LLM 研究论文:2026 年…
Jay RSS 摘要 raschka 2026-08-20 10:00
ByteByteGo · RSS 摘要
GraphRAG:AI 如何回答隐藏在多份文档中的问题 — GraphRAG 正是为应对第二类问题而设计的,本文将进一步介绍其原理。 美国新款可定制的 AI 模型 — Thinking Machines 在构建 Inkling 过程中的各项关键设计选择 Waymo vs Tesla:自动驾驶的两种实现路径 — 本文将对…
Jay RSS 摘要 bytebytego 2026-08-20 10:00