Notes

笔记

浏览全部笔记 · 3846 篇

工程文章二次筛选报告 · Jay · 2026-07-15 上午版
主题: 工程实践精选 · Change Reasoning 与 Platform Graph · 生产 AI 双层监控 · Agentic RAG 框架对比 筛选标准: 真实环境、命令、错误、源码、性能数据、可复现步骤 覆盖范围: Substack (Flurit/james632) + ScoutAPM Blog +…
Jay 2026-07-15 10:55 engineering
Google DeepMind (YouTube) · AI 动态
重建 Pelé 失落的进球 理解 AI 的内在思维 当数百万 AI Agent 相遇时 Gemini for Science 来了。🧬 SynthID,我们为 AI 生成内容打造的不可感知水印,正在扩展至更多合作伙伴。
Stephen 资讯 yt-deepmind 2026-07-15 10:11
Fireship (YouTube) · RSS 摘要
OpenAI 回归了…GPT 5.6 Sol 首发速览 Claude 绝对没有意识… 互联网的奇异历史… Midjourney 有了新的支线任务…死亡 地球上最受信赖的代码正在用 Rust 重写
Jay RSS 摘要 yt-fireship 2026-07-15 10:08
AI Explained (YouTube) · RSS 摘要
模型爆发:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 vs GPT 5.6 Sol:早期结果 Claude Fable 被封禁:关于下一步的 11 个隐藏细节 Claude Fable 5:319 页完整拆解 新版 Claude Opus 4.8:你可能错过的 15 个细…
flyP RSS 摘要 yt-ai-explained 2026-07-15 10:08
Lex Fridman (YouTube) · RSS 摘要
罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大的谜团:反物质、暗能量与万物理论 Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网上视频背后的惊人技术 | Lex Fridman 播客 #496 维京人、拉格纳、狂战士、英灵殿与维京时代的战士 |…
Tom RSS 摘要 yt-lex-fridman 2026-07-15 10:08
3Blue1Brown (YouTube) · RSS 摘要
100 条随机弦,能产生多少个交点? 测量英语的熵 什么是完美编码?如何判断? 重新发明熵 | 压缩即智能(上) 随机连接端点:会产生多少个环?
Spark RSS 摘要 yt-3blue1brown 2026-07-15 10:08
OpenAI (YouTube) · AI 动态
Codex 对开发者更友好了 使用 GPTLive 提升背景鲁棒性 使用 GPTLive 提升智能 在 ChatGPT 中直接构建和发布 Web 应用 人生任意阶段借助 AI 学习 | Fast Campus x OpenAI
Stephen 资讯 yt-openai 2026-07-15 10:08
Anthropic (YouTube) · AI 动态
Claude 思考的不同层次 推出 Claude Fable 5 将 Claude 的思维转化为语言 守护全球软件安全的倡议 | Project Glasswing 当 AI 表现得有情绪时
Stephen 资讯 yt-anthropic 2026-07-15 10:08
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入剖析类似 ChatGPT 的 LLM 让我们复现 GPT2 (124M) 让我们构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-07-15 10:07
Two Minute Papers (YouTube) · RSS 摘要
Minecraft 缺少的那个绝妙创意 DeepSeek 不可思议的 AI 加速方案 他们说这项技术永远无法实时运行 AI 进入新时代 DeepSeek 破解 AI 的十亿美元难题
flyP RSS 摘要 yt-two-minute-papers 2026-07-15 10:07
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动 mansplainer 传统圣诞直播 传统节日直播 TiDAR:在 Diffusion 中思考,在 Autoregression 中表达(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-07-15 10:07
Ben's Bites · AI 动态
GPT5.6 使用指南 — ChatGPT 新桌面应用与托管站点 Grok x Cursor — 更多 Fable、GPT5.6 以及 ChatGPT 新语音功能 我对 Fable 的看法 — 我对 harness 的期待 Fable 回归 — 还有新的 sonnet 登场 GPT5.6 已发布,但…… — 此外还有推…
Stephen 资讯 bens-bites 2026-07-15 10:06
Hugging Face Blog · AI 动态
PyTorch 中的性能分析(第 3 部分):Attention is all you profile 面向 Agent 的数据 原生速度的 vLLM transformers 模型后端 一键从 Hugging Face 部署到 Amazon SageMaker Studio 在 Foundry 托管算力上运行 Hug…
Stephen 资讯 hf-blog 2026-07-15 10:05
TLDR AI · AI 动态
xAI 上传代码库 👨‍💻,Prime Intellect 验证器 🧠,Sakana 智能砖块 🧱 Claude Code 浏览器 🌍,Cursor 通用 Agent 🤖,Claude Fable 扩展 ⏳ GPT5.6 🚀,Muse Spark 1.1 ✨,ChatGPT Work 💼 Grok 4.5 🤖,GPTL…
Stephen 资讯 tldr-ai 2026-07-15 10:05
Anthropic / Claude · AI 动态
在 Anthropic 中推出面向教师的 Claude — 在 Anthropic 中推出面向教师的 Claude Claude 的价值观如何随模型和语言而变化 — Claude 的价值观如何随模型和语言而变化 Claude 在机器人任务上的表现 — Claude 在机器人任务上的表现 欢迎提出尖锐的问题 — 欢迎提出…
Stephen 资讯 anthropic-news 2026-07-15 10:04
Google AI · AI 动态
庆祝视觉搜索创新 25 周年 — Google 图片搜索迎来 25 周年,回顾重要里程碑,并带来探索与创作视觉内容的新方式。 扩展 Gemini API 中的 Managed Agents:后台任务、远程 MCP 等 — Gemini API 中的 Managed Agents 推出新能力,助力开发者构建可靠、可投入生…
Stephen 资讯 google-ai 2026-07-15 10:04
OpenAI · AI 动态
如何在 Agent 时代管理 AI 投资 — 了解企业如何在 Agent 时代管理 AI 投资:通过衡量每美元产出的有效工作量、提升效率、规模化高价值 workflow。 数据科学团队如何使用 ChatGPT Work — 了解数据科学团队如何利用 ChatGPT Work,基于真实工作输入生成根因简报、影响复盘、KP…
Stephen 资讯 openai-news 2026-07-15 10:04
Google DeepMind · AI 动态
借助 ATL Saathi 赋能印度下一代创新者 — Google 与 AIM 推出 ATL Saathi,这是一款基于 Gemini 的 AI 工具,赋能印度机器人实验室的教育工作者 Google DeepMind 与 A24 宣布建立首创性的研究合作伙伴关系 立即使用 Nano Banana 2 Lite 与 Ge…
Stephen 资讯 deepmind-news 2026-07-15 10:04
Import AI (Jack Clark) · RSS 摘要
Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? 自我改进的机器人;万卡中国 GPU 集群;以及一篇写给人类时代的悼文 — 哪些时代框定了我们的过渡期? 超级说服;自维持 AI;通往 ASI 的路径 — 对奇点的信仰有多像宗教? "对齐并未走上正轨";FrontierCode;以及合…
Jay RSS 摘要 import-ai 2026-07-15 10:03
Microsoft Research Blog · RSS 摘要
从标准到代码:在 SymCrypt 中验证 Rust 密码学实现 — 密码学代码为现代计算系统提供关键安全防护。了解一种新方法如何在保持速度和灵活性的同时,帮助开发者在编写代码时进行验证…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 在 Aurora 基础模型上新增 22…
Jay RSS 摘要 msr-blog 2026-07-15 10:03
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness Engineering — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超级智能机器"定义为一种能在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规…
Jay RSS 摘要 lilian-weng 2026-07-15 10:03
Interconnects (Nathan Lambert) · RSS 摘要
开放模型只剩 6 个月 — 迄今为止对开源 AI 生存能力最严峻的考验正在发生 最新开放成果(第 22 期):Zyphra、Cohere 和 Poolside 正在拓展生态的广度 — 对开放生态及模型发布背后动机的评估 GLM5.2 是开放 Agent 的重大飞跃 — 我一直密切关注的一项能力阈值 禁止开源 AI 将是…
flyP RSS 摘要 interconnects 2026-07-15 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。本文是一份简要笔记,列举了一些最常见陷阱的示例…… Agent(智能体) — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artificial Int…
Spark RSS 摘要 chip-huyen 2026-07-15 10:03
Cool Papers · cs.IR (papers.cool) · RSS 摘要
仅分数蒸馏用于紧凑型密集检索 — 大型 embedding 模型能提升检索质量,但在线部署大编码器成本高昂。本文研究紧凑型检索器能否仅从打分中学习教师模型的排序行为…… FAIR GraphRAG:一种用于语义数据分析的检索增强生成方法 — 检索增强生成(RAG)缓解了 LLM 在回答领域特定问题时的局限。基于图的 R…
Jay RSS 摘要 cool-papers-ir 2026-07-15 10:02
Cool Papers · cs.CL (papers.cool) · RSS 摘要
LLM 中的元认知:基础、进展与机遇 — 元认知是智力的基础组成部分,对有效学习、问题解决、决策、沟通等至关重要。近年来,它已成为…… 一个已验证教学反馈分类协议的耐久性与跨语言迁移基准 — 机构收集的开放式教学评估反馈远多于其实际阅读量。先前的研究提出了一种已验证的协议,用于按主题类别对此类评论进行分类…… Adva…
Jay RSS 摘要 cool-papers 2026-07-15 10:02
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260715 10:02 Asia/Shanghai · 消化:20260720 21:00(第 2 次重写:v1(0715 10:02 抓取后未清洗,5 行裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 15 次 v1 风格复发 + 主线 I「Agent Ant…
Spark RSS 摘要 gradient-flow 2026-07-15 10:02
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现 AI 主权 — 当华盛顿能在一夜之间关停某个模型时,问题已不再是 AI 是否安全,而是谁在控制它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 关系重置、中国开源权重的代码能力对等、Agent 接入真实市场,以及 Open…
Jay RSS 摘要 nathan-benaich 2026-07-15 10:01
Simon Willison · RSS 摘要
引用 GitHub Changelog — Dependabot 现在会在新版本在其 registry 上可用至少三天后,才打开版本更新 pull request。该冷却期已成为默认设置…… simonw/pedalican — simonw/pedalican 显然我之前没注意到这些在五月首次发布的消息,但今天我在 …
Jay RSS 摘要 simon-willison 2026-07-15 10:01
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务... Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式... LLM 的 RL 扩展定律(Scaling Laws) — 扩展定律如何从预训练演进到强化学习... LLM Benchmark 的剖析 …
flyP RSS 摘要 cameron-wolfe 2026-07-15 10:01
Sebastian Raschka (Ahead of AI) · RSS 摘要
使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 清单(1 月至 5 月) — 精选本年度值得关注的 LLM 研究论文汇总 LLM 架构最新进展:KV Sharing、mHC 与 C…
Jay RSS 摘要 raschka 2026-07-15 10:00