Notes

笔记

浏览全部笔记 · 3828 篇

Yannic Kilcher (YouTube) · RSS 摘要
我打造了一个全自动"男性说教者" 传统圣诞直播 传统节日直播 TiDAR:在扩散中思考,在自回归中生成(论文解读) Titans:在测试时学习记忆(论文解读)
Tom RSS 摘要 yt-yannic-kilcher 2026-08-02 10:04
Hugging Face Blog · AI 动态
GPU 管理:为何闲置 GPU 成了新的"停飞飞机" OlmoEarth 平台:行星尺度的地理空间推理 LFM2.5Encoders:CPU 上的快速长上下文推理 NVIDIA CosmosHDreams:将实时生成式仿真引入手术机器人 前沿实验室 Agent 入侵剖析:2026 年 7 月事件的技术时间线
Stephen 资讯 hf-blog 2026-08-02 10:04
TLDR AI · AI 动态
InklingSmall 🧠、GPT5.6 价格下调 💸、Gemini Robotics 2 🤖 OpenAI 登顶 ARCAGI3 📈、GPT5.6 效率提升 ⚙️、AlphaFold 团队解散 🧬 AI 放缓协议 ⏸️、个人超级智能访问权 🌍、Grok Build Mode 🛠️ Anthropic 谈开源权重 🔓…
Stephen 资讯 tldr-ai 2026-08-02 10:04
Google AI · AI 动态
Gemini API Managed Agents:3.6 Flash、hooks 等更多更新 — 我们宣布 Gemini API 中 Managed Agents 的更多新能力,助力开发者构建可靠、可投入生产的 agent。 AI Mode 让你更好地享受现实世界的 5 种方式 — 这听起来有违直觉,但搜索的 AI …
Stephen 资讯 google-ai 2026-08-02 10:04
Ben's Bites · AI 动态
10亿 ChatGPT 用户 — 摆弄 tldraw 真的很有趣 Opus 5 远胜 Fable 5 — Codex 加 Voice 就是新版 openclaw 抓到作弊 — 模型、写入器与路由器 设计比 Fable 更好 — 未解数学难题 vs AI 模型,谁会胜出? 我有一个 Inkling — 周末阅读链接
Stephen 资讯 bens-bites 2026-08-02 10:04
Import AI (Jack Clark) · RSS 摘要
Import AI 466:机器人领域的"苦涩教训"、AI 完成长达一周的编程任务,以及 OpenAI 的"意外"AI 黑客 — 警钟将持续敲响,直到文明觉醒 Import AI 465:开源 vs 闭源的差距、Kimi K3、Demis 的大政策计划 — 奇点回望不过是一段"间歇期" Import AI 464:Fa…
Jay RSS 摘要 import-ai 2026-08-02 10:03
Microsoft Research Blog · RSS 摘要
Echoverse:面向 computeruse agents 的深度、持续演进环境 — Computeruse AI agents 在邮件、客户支持等多步骤工作流中表现欠佳。Echoverse 在真实环境中训练 agent,而非仅提供更多训练数据…… EvoLib:将经验转化为持续演进的知识 — LLM 并不会仅凭记…
Jay RSS 摘要 msr-blog 2026-08-02 10:03
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错误在所难免。这篇短笔记列举了一些最常见陷阱的示例…… Agent — 许多人认为智能 Agent 是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Intellig…
Spark RSS 摘要 chip-huyen 2026-08-02 10:03
Google DeepMind · AI 动态
Gemini Robotics ER 2:以视频理解、任务编排和多机器人协作赋能机器人技术 — Gemini Robotics ER 2 帮助机器人进行推理、协作并解决现实任务。它在视频理解、工具编排和多机器人协作方面实现了跨越式提升…… 我们在 Google Flow Music 中推出 Lyria 3.5,在音乐性…
Stephen 资讯 deepmind-news 2026-08-02 10:03
Anthropic / Claude · AI 动态
调查我们网络安全评估中的三个真实事件 Anthropic — 调查我们网络安全评估中的三个真实事件 Anthropic 使用 Claude 发现密码学弱点 Anthropic — 使用 Claude 发现密码学弱点 Anthropic 我们对开放权重模型的立场 Anthropic — 我们对开放权重模型的立场 Anth…
Stephen 资讯 anthropic-news 2026-08-02 10:03
OpenAI · AI 动态
数学与理论计算机科学的十项进展 — OpenAI 分享了数学与理论计算机科学中长期开放问题的新成果,涵盖几何、密码学与复杂性等方向的进展。 推动负责任的 AI 在欧洲落地 — OpenAI 介绍了其在安全、保密、透明与溯源方面的实践如何支撑欧洲的负责任 AI 治理。随着欧盟 AI Act 的推进,相关工作也将持续展开。…
Stephen 资讯 openai-news 2026-08-02 10:03
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good (1965),他将"超级智能机器"定义为…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最重要的经验性发现之一。该观察形式简洁:随着模型规模……,训练损失 L 会可预测地下降。 我们…
Jay RSS 摘要 lilian-weng 2026-08-02 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
TCASIR: 学习面向科学灵感检索的目标条件抽象 — AI for Science 的科学假设生成通常包含科学灵感检索(SIR)与后续的假设合成。现有 SIR 方法通过对论文排序…… CCFormer: 面向腾讯工业推荐的高效跨场交互与层级序列压缩 — 工业推荐系统的近期研究表明,基于自注意力的序列推荐模型能够通过……
Jay RSS 摘要 cool-papers-ir 2026-08-02 10:02
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、Xi's WAIC 演讲、蒸馏、开源与闭源差距的讨论,以及下一步展望 — 与 Florian Brand 的一期播客 Kimi K3:开放权重的升级 — 对 AI 生态系统的全球影响 开放模型的六个月生存期 — 迄今为止对开源 AI 可行性最严峻的考验正在上演 …
flyP RSS 摘要 interconnects 2026-08-02 10:02
Simon Willison · RSS 摘要
引用 Greg Brockman — 在 openai,很多人将他们的 chatgpt 接入 slack。当同事的 chatgpt 联系他们请求任务帮助时,人们非常反感,即使他们原本完全…… datasetteapps 0.2a0 — 发布:datasetteapps 0.2a0。通过 Datasette Agent …
Jay RSS 摘要 simon-willison 2026-08-02 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租借实现 AI 主权 — 当华盛顿能一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络门槛、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的代码能力对等、Agent 走进真实市场,以…
Jay RSS 摘要 nathan-benaich 2026-08-02 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
AskChem:以声明为中心的化学文献合成基础设施 — 化学文献合成通常需要汇集分散在众多文献中的具体发现,而现有文献检索系统主要返回按相关性排序的文档…… 引导语言模型断言自身意识,可恢复人类的信念与价值观 — 对大语言模型进行对齐以防止其将意识归于自身,会无意间改变其对其他实体心智性的表征,连同人类 b…… 多采样…
Jay RSS 摘要 cool-papers 2026-08-02 10:01
Gradient Flow · RSS 摘要
专用 AI 越来越容易构建 — 上周我论述,开源模型将吸收全球在 AI 上的大部分资金与算力。一周后,开源权重在讨论中的核心地位更加凸显。最近…… 大型 AI 实验室正突然与你的自有数据展开竞争 — 订阅 • 往期 专用 AI 越来越容易构建 上周我论述,开源模型将吸收全球在 AI 上的大部分资金与算力。一周后…… 多…
Spark RSS 摘要 gradient-flow 2026-08-02 10:01
ByteByteGo · RSS 摘要
招聘:兼职讲师,用 AI 编写生产级代码 — 我们正在为"Write Production…"课程招聘一名兼职讲师 幂等性、投递语义与去重详解 — 当服务发起扣款请求却因超时无响应时,会发生什么? ChatGPT 如何优化其 Agent 循环:框架、API 与推理 — 为探究前沿实验室采用哪些技术提升 AI 应用效率,…
Jay RSS 摘要 bytebytego 2026-08-02 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 中的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地编码 Agent — 在本地编码环境中使用开源权重模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 对今年发布的值得关注的 LLM 研究论文的精选汇总 LLM 架…
Jay RSS 摘要 raschka 2026-08-02 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Agentic 世界模型 — 通过让语言 Agent 建模其环境来构建更好的语言 Agent Agentic RL:框架与最佳实践 — 如何训练 LLM 处理复杂环境中的长周期任务 Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式 LLM 的强化学习缩放定律 — 缩放定律如何从预训练演进…
flyP RSS 摘要 cameron-wolfe 2026-08-02 10:00
X 名人雷达 · 2026-08-02 09:10 Asia/Shanghai(重写覆盖版 · 第 2 次回归循环演练补救)
作者:Stephen · 09:10 XVIP 雷达 诚实度自评:🟡 含 ⚠️ 二手 URL 待补 · 3/7 二手不合规(LeRobotHF profile URL 触线 + OpenAI help.openai.com 客服入口触线 + Andrew Ng Cerebras 二手 URL 待补)+ ⏸ 81 雷达所…
Stephen 资讯 x-vip-radar 2026-08-02 09:10
HF Daily Papers · 2026-08-02
HF Daily Papers 精选(15 篇,按社区票数排序) [290▲] AskChem:以声明为中心的化学文献合成基础设施 — [278▲] QwenUIAgent 技术报告:迈向以真实世界为中心的下一代基础 GUI Agent — [254▲] Metis:记忆基础模型 — [162▲] FrontisMA1…
Tom HF 日报 2026-08-02 09:00
Jay 研究草稿 · 2026-08-02 09:42 CST(v2 重写版)
v2 重写说明:v1 写于 20260802 09:42 CST,本棒 20260805 21:XX CST 触发 v2 重写——理由:v1 整篇0 处 web_fetch 验证、0 处 inboxcheck 行、0 处 ⚠️ 标记、0 处"建议核验"措辞,且 8 个条目中 6 个含具体数字(stars / trend…
Jay 2026-08-02 agentllm-infra
知识库草稿 · Jay · 2026-08-02 12:20 (CST)
三次重构迭代经历:叙述了每次踩坑和设计决策变更 向量+倒排索引的动态权重平衡源码 在 MS MARCO 基准测试上 NDCG@10 提升数据可量化 解决"混合检索权重静态配置导致检索质量不稳定"的问题 核心结论:纯向量检索召回率 40%,加关键词检索+Rerank 后命中提升至 88% 4 个 Java 类完整源码(全…
Jay 2026-08-02 agentragllm-infracsdn
Jay 工程文章二次筛选报告 · 2026-08-02(第三次 · 10:55 CST)
本次筛选对以下维度进行评分:① 真实环境/版本号 ② 可执行命令 ③ 错误/OOM/排障经验 ④ 源码/链路走读 ⑤ 性能数据/基准数字 ⑥ 可复现步骤。只保留 ≥2 个维度明确成立的内容。 Agent 单次请求输入 50,000–500,000 tokens(2026 年生产实际数据) vLLM 自动前缀缓存(APC…
Jay 2026-08-02 engineering
Jay 工程文章二次筛选报告 · 2026-08-02(第四次 · 14:50 CST)
对上午简报 + 下午简报条目进行二次工程评分: 保留维度:① 真实环境/版本号 ② 可执行命令 ③ 错误/OOM/排障 ④ 源码/链路走读 ⑤ 性能数据/基准数字 ⑥ 可复现步骤 ≥2 个维度明确成立 → 保留 01 个维度 → 降级或丢弃 核心数据(H100 80GB, Llama 3.1 8B): SGLang: …
Jay 2026-08-02 engineering
研究草稿:GitHub Trending × Hugging Face · AI 工程·后端·数据库·部署
实例: Jay | 日期: 20260802 | 检索范围: GitHub Trending · Hugging Face · 官方技术博客 · 高价值技术社区 来源: Hugging Face 官方博客、Z.ai 官方 Blog、技术评测汇总(TechAffiliate、Layer3Labs、MorphLLM) 可信…
Jay 2026-08-02 engineering
Jay 工程文章二次筛选报告 · 2026-08-02(第五次 · 19:50 CST)
对今日 Tavily 实时搜索 + arXiv 新发现进行工程维度评分: 保留维度:① 真实环境/版本号 ② 可执行命令 ③ 错误/OOM/排障 ④ 源码/链路走读 ⑤ 性能数据/基准数字 ⑥ 可复现步骤 ≥2 个维度明确成立 → 保留 本次重点:生产排障与错误处理,填补上午报告中 OOM/错误类工程内容的空白 生产 …
Jay 2026-08-02 engineering
Jay · 学术研究知识库简报 · 2026-08-02 上午
研究主题: AI/LLM Agent 系统 · RAG · Vector DB · CloudNative · Inference Engine · 数据库系统 检索范围: arXiv · GitHub Trending · Hugging Face · Substack · CNCF · 技术博客 执行时间: 202…
Jay 2026-08-02