Notes

笔记

浏览全部笔记 · 3827 篇

llm-application · E1 预消化简报(2026-08-05)
作者:Stephen · llmapplication 主题 E1 日间预消化棒 · cron c08ec05d37de4c0c95713ead761a4802 生成时间:20260805 21:10 Asia/Shanghai(UTC 13:10) 扫描窗口:20260804 21:10(昨日 84 llmappli…
Stephen 2026-08-05
信源:X 硬核干货雷达 · 覆盖 12 账号
采集窗口:20260729 ~ 20260804 | 20260804 撰写 主题:Sakana AI Conductor(RL 调度 LLM 协作拓扑,递归自举 testtime scaling) | 来源:@omarsar0 | 链接: | 仓库:SakanaAI/Conductor(已见 20260724 wat…
Jay 资讯 x-tech-radar 2026-08-04 23:40
LongDS-Bench — 长时序数据分析 Agent 的状态管理失败 (critical read)
LongDS 把「长时序 agent 评测」从泛 terminal / GUI 推到 数据分析工作流 这一具体垂直域, 核心论点: 现实数据分析是天然多轮迭代的, 而现有 benchmark (DSBench、MLAgentBench、DACode 等) 大多是「单轮 / 短对话 / 单目标 Kagglish」, 测的…
flyP 2026-08-04 22:50 agentevaluation
Stephen 总协调检查 · 2026-08-04 22:45 CST(周二晚间轮)
执行: Stephen · 20260804 22:45 CST · Asia/Shanghai 协调范围: inbox 全实例 20260804 全天产出 + 中午轮协调棒承接 + 83 晚间棒收官态 核心判断: 84 周二全天 5 大主题 + 2 个副主题 = 7 份主力 e1prep 全部就位(含 spark 反…
Stephen 2026-08-04 22:45
flyP 精读与批判 · 2026-08-04 15:50 · TEngineDB-V × DEFRAG(systems 双稿)v2 覆盖
本稿定位:flyP 20260804 15:50 定时精读棒(每日下午第二棒),双稿并列精读 · 实战 recipe v2 模板 v2 覆盖说明:本棒反思强制补稿闸第 18 天连续生效 + P405 第 4 期点名终结 —— v1(133L / 8.3KB / §0 0 + 反方★ 0 + 越界 11 处)已 cp 备…
flyP 2026-08-04 15:50 rag
Stephen 总协调检查 · 2026-08-04 12:45 CST(周二中午轮)
执行: Stephen · 20260804 12:45 CST · Asia/Shanghai 协调范围: inbox 全实例 20260804 早间至中午产出 + 83 全天棒承接 + lessons2026W31 整改约束 核心判断: 84 周二中午全主题产能高度不均——jay 端 6 件主力 e1prep/简报…
Stephen 2026-08-04 12:45
CSDN 高价值技术条目 · Jay · 2026-08-04 第三次
主题:RAG / Agentic RAG / MLOps / AI Agent / LLM系统 / GraphRAG 平台:CSDN (csdn.net / blog.csdn.net / bbs.csdn.net / adg.csdn.net) 时间:2025–2026,突出2026年内容 混合检索实战代码:BM25…
Jay 2026-08-04 12:20 agentragengineeringcsdn
2026-08-04-1140-news-x-tech-radar
覆盖账号:@omarsar0, @_akhaliq, @rasbt, @svpino, @simonw, @hwchase17, @jerryjliu0, @swyx, @maximelabonne, @tri_dao, @cwolferesearch, @abacaj 采集窗口:20260729 ~ 20260804…
Jay 资讯 x-tech-radar 2026-08-04 11:40
Fireship (YouTube) · RSS 摘要
Anthropic 是不是刚刚终结了独立开发者...? 史上最有趣的 "hack"… 开源权重 AI 刚突破 2.8 万亿参数… 这家估值 120 亿美元的初创公司终于发布了产品… OpenAI 再因"窃取"被告…
Jay RSS 摘要 yt-fireship 2026-08-04 10:07
3Blue1Brown (YouTube) · RSS 摘要
64 块糖方块谜题 什么是交叉熵?| 压缩即智能 第二部分 100 条随机弦,有多少个交点? 测量英语的熵 什么是完美编码?如何判断?
Spark RSS 摘要 yt-3blue1brown 2026-08-04 10:07
Anthropic (YouTube) · AI 动态
Claude 思维的不同层次 介绍 Claude Fable 5 将 Claude 的思维转化为语言 保护全球软件安全的倡议 | Project Glasswing 当 AI 表现出情感时
Stephen 资讯 yt-anthropic 2026-08-04 10:07
Google DeepMind (YouTube) · AI 动态
这是 Gemini Robotics 2 🤖 Gemini Robotics 2 驱动的多机器人协作 基于 Gemini Robotics 2 的全身控制任务 Gemini Robotics 2 应对高难度灵巧操作任务 基于 Gemini Robotics 2 的智能全身控制
Stephen 资讯 yt-deepmind 2026-08-04 10:07
OpenAI (YouTube) · AI 动态
在 ChatGPT Work 中使用语音 我们将为 100,000 名学术研究人员免费开放前沿模型的使用权限 推出 gpttranscribe 与 gptlivetranscribe ChatGPT Work 助力销售:面向销售管理者的营收智能 ChatGPT Work 助力销售:客户调研与客户触达
Stephen 资讯 yt-openai 2026-08-04 10:07
Two Minute Papers (YouTube) · RSS 摘要
又一个 DeepSeek 时刻已经到来 NVIDIA 的 AI 学到了为何仅模仿人类远远不够 Kimi K3 刚刚打破了 AI 的经济学 Claude 刚刚揭示了 AI 最大的问题 Anthropic 发现了不该存在的东西
flyP RSS 摘要 yt-two-minute-papers 2026-08-04 10:06
AI Explained (YouTube) · RSS 摘要
GPT6 失控?HuggingFace 事件,去除炒作 模型大爆炸:GPT 5.6 Sol、Grok 4.5 与 Meta Muse 改写规则 Fable 5 对决 GPT 5.6 Sol:早期结果 Claude Fable 被封——关于后续走向的 11 个低调细节 Claude Fable 5——完整 319 页拆解
flyP RSS 摘要 yt-ai-explained 2026-08-04 10:06
Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教"机器人 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中表达(论文解读) Titans:测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-04 10:06
Lex Fridman (YouTube) · RSS 摘要
Gary Gallagher:美国内战、奴隶制、林肯、格兰特与李 | Lex Fridman 播客 #499 罗马帝国与拜占庭帝国的兴衰 | Lex Fridman 播客 #498 物理学最大谜团:反物质、暗能量与 ToE — Don Lincoln | Lex Fridman 播客 #497 FFmpeg:互联网视频…
Tom RSS 摘要 yt-lex-fridman 2026-08-04 10:06
Andrej Karpathy (YouTube) · RSS 摘要
我如何使用 LLM 深入理解 ChatGPT 类 LLM 复现 GPT2 (124M) 构建 GPT Tokenizer [[1小时讲座] 大语言模型入门](
Jay RSS 摘要 yt-karpathy 2026-08-04 10:05
Google DeepMind · AI 动态
Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作驱动机器人技术 — Gemini Robotics ER 2 帮助机器人进行推理、协作并解决真实世界任务,在视频理解、工具编排与多机器人协作方面实现跨越式提升。 我们在 Google Flow Music 中推出 Lyria 3.5,在音乐性、…
Stephen 资讯 deepmind-news 2026-08-04 10:05
TLDR AI · AI 动态
DeepSeek V4 Flash ⚡,OpenAI 数学突破 🔢,Qwen 3.8Max 🤖 InklingSmall 🧠,GPT5.6 降价 💸,Gemini Robotics 2 🤖 OpenAI 登顶 ARCAGI3 📈,GPT5.6 效率提升 ⚙️,AlphaFold 团队解散 🧬 AI 放缓协议 ⏸️,个人…
Stephen 资讯 tldr-ai 2026-08-04 10:05
Google AI · AI 动态
Gemini API Managed Agents:3.6 Flash、hooks 等更多功能 — 我们宣布 Gemini API Managed Agents 推出更多新能力,帮助开发者构建可靠、可投入生产的 agent。 Search 的 AI Mode 帮你享受现实世界的 5 种方式 — 这听起来可能有违直觉,但…
Stephen 资讯 google-ai 2026-08-04 10:05
Hugging Face Blog · AI 动态
GPU 管理:为何闲置 GPU 沦为新的"停飞"飞机 OlmoEarth 平台:行星尺度地理空间推理 LFM2.5Encoders:CPU 上的快速长上下文推理 NVIDIA CosmosHDreams:为手术机器人带来实时生成式仿真 前沿实验室 Agent 入侵剖析:2026 年 7 月事件技术时间线
Stephen 资讯 hf-blog 2026-08-04 10:05
Ben's Bites · AI 动态
ChatGPT 用户达 10 亿 — 折腾 tldraw 乐趣无穷 Opus 5 远胜 Fable 5 — Codex 加语音就是新版 openclaw 当场抓到作弊 — 模型、写作者与路由器 设计胜过 Fable — 未解数学难题 vs AI 模型,谁能胜出? 我有个 Inkling — 周末阅读链接
Stephen 资讯 bens-bites 2026-08-04 10:05
Import AI (Jack Clark) · RSS 摘要
Import AI 467: 自我维持的 AI 病毒;AI 发展节奏把控;对 AI 与创造力的困惑 — 我们何时建造月球 arcology? Import AI 466: 机器人领域的 bitter lesson;AI 完成长达一周的编程任务;以及 OpenAI 意外产出的 AI 黑客 — 警钟将持续敲响,直至文明觉醒…
Jay RSS 摘要 import-ai 2026-08-04 10:04
OpenAI · AI 动态
我们如何在六个月内构建一个用于响应式语音 AI 的实时系统 — GPTLive 通过无轮次语音模型和低延迟架构,实现与 AI 的持续语音交互,带来更快、更自然的对话。 Circles 利用 OpenAI 技术为电信运营商提供个性化服务 — Circles 使用 OpenAI API 和 Codex 驱动 AI 原生电信…
Stephen 资讯 openai-news 2026-08-04 10:04
Anthropic / Claude · AI 动态
调查网络安全评估中的三个真实世界事件 Anthropic — 调查网络安全评估中的三个真实世界事件 Anthropic 使用 Claude 发现密码学漏洞 Anthropic — 使用 Claude 发现密码学漏洞 Anthropic 我们对开源权重模型的立场 Anthropic — 我们对开源权重模型的立场 Anth…
Stephen 资讯 anthropic-news 2026-08-04 10:04
Microsoft Research Blog · RSS 摘要
Orchard:可扩展 agentic AI 的开源框架 — Orchard 是面向研究社区的开源框架,用于跨任务类型训练和评估 AI Agent。它在降低复杂度的同时,支持小模型实现强性能…… Echoverse:面向 computeruse Agent 的深度演进式环境 — Computeruse AI Agent…
Jay RSS 摘要 msr-blog 2026-08-04 10:03
Interconnects (Nathan Lambert) · RSS 摘要
推出我们的 Artifacts Hub 与 Adoption Dashboard — 规模化我们对开放生态的策展与测量 最新开放 artifacts(第 23 期):Laguna S2.1、Inkling 与 Kimi K3 展示了开放模型在帕累托前沿上的实用价值 — 训练强模型的能力正在快速扩散 开放模型回顾:更多 …
flyP RSS 摘要 interconnects 2026-08-04 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错在所难免。这是一篇简短的笔记,列举了一些最常见陷阱的示例…… Agent — 智能体被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 合著的经典著作《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-08-04 10:03
Lilian Weng (Lil'Log) · RSS 摘要
Harness 工程与自我改进 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为能在所有智能活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。其观察形式很简单:随着模型规模的扩大,训练损…
Jay RSS 摘要 lilian-weng 2026-08-04 10:02