Notes

笔记

浏览全部笔记 · 3714 篇

Google AI · AI 动态
5种用Search提升学习效果的新方法 — 介绍如何借助Google Search工具备考课程和标准化考试。 借助Gemini和Pixel,更近距离感受比赛 — Google Gemini和Pixel与五家全球足球俱乐部合作,通过AI与智能手机技术提升球迷的观赛体验。 用Sheets canvas让电子表格数据栩栩如生…
Stephen 资讯 google-ai 2026-08-23 10:03
TLDR AI · AI 动态
ChatGPT 苹果信息 💬, Anthropic 的会议录音 💼, Mistral Agentic Search 🔍 Muse Video 泄露 📹, Ramp Router 上线 🔀, Stripe 收购 OpenRouter 的原因 💰 GLM5.3 API 🤖, Cerebras 新芯片 ⚡, OpenAI 网…
Stephen 资讯 tldr-ai 2026-08-23 10:03
Google DeepMind · AI 动态
从 Atari 到 EVE Online:在 15 年游戏 AI 研究基础上的再出发 — Google DeepMind 与游戏工作室合作,原型化突破性 AI 游戏玩法。 推出 Gemini 3.7 Flash 将手语 AI 交到用户手中 — 推出手语转文本(SL2T)模型,为听障和重听用户提供突破性的手语功能。 We…
Stephen 资讯 deepmind-news 2026-08-23 10:03
Hugging Face Blog · AI 动态
衡量语音识别中的基准测试优化 使用 LFM2.5DSpark 实现最高 3.2 倍推理加速 你的 Agent 实际需要多少内存? 基于 Sentence Transformers 的多向量(晚期交互)嵌入模型 同一集群,利用率提升 33 个百分点:改变的只是顺序
Stephen 资讯 hf-blog 2026-08-23 10:03
Ben's Bites · AI 动态
我是如何构建的 — Ben 的会话 #3 简单的 Agent — Slack 是新的 IDE 你使用个人 Agent 吗? — 给 AI 提供完整的桌面活动历史 Ben 的会话 #2 — 什么是个人 Agent? Grok Bot 并非你所想的那样 — 以及可与 Agent 一起尝试的技能和工具
Stephen 资讯 bens-bites 2026-08-23 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究者 Import AI 468:23 个 RSI 想法;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467…
Jay RSS 摘要 import-ai 2026-08-23 10:02
Microsoft Research Blog · RSS 摘要
扩展 Skala 的可及性,为预测性 DFT 提供更快路径 — Skala 1.1 是来自 Microsoft Research 的更新版深度学习交换关联泛函,在计算化学领域带来了更高精度和更广的可及性…… MindTopo 揭示了 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 A…
Jay RSS 摘要 msr-blog 2026-08-23 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于基于基础模型构建应用仍处于早期阶段,犯错在所难免。本文简要列举了一些最常见 pitfa……的示例 Agents — 许多人认为 intelligent agents 是 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artifici…
Spark RSS 摘要 chip-huyen 2026-08-23 10:02
Anthropic / Claude · AI 动态
Claude 如何加速蛋白质设计与分析化学 — Claude 如何加速蛋白质设计与分析化学 Claude 文本水印的工作原理 — Claude 文本水印的工作原理 新兴多智能体系统中的模式与问题 — 新兴多智能体系统中的模式与问题 如何在 Google Cloud 上控制 Claude Code 成本并展示 ROI —…
Stephen 资讯 anthropic-news 2026-08-23 10:02
OpenAI · AI 动态
介绍 AI Futures — 介绍 AI Futures,这是 OpenAI 的新博客,探讨变革性 AI 如何重塑权力、治理、经济和个人自由。 Stampli 使用 ChatGPT Work 将发布时间缩短 68% — 在截止日期固定且设计资源已投入其他项目的情况下,Stampli 使用 Codex 和 ChatGP…
Stephen 资讯 openai-news 2026-08-23 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
将 BrowseCompPlus 投影到 ClimbMix:迈向更真实的 Agentic Search 语料库 — BrowseCompPlus 基准通过用固定语料库替代不透明的网络搜索,解耦了 Agentic search 的评估,从而可将 Agent 的角色与检索器的作用分离开来…… 怎样的 Fiqh 检索器才算优…
Jay RSS 摘要 cool-papers-ir 2026-08-23 10:01
Lilian Weng (Lil'Log) · RSS 摘要
面向自我改进的 Harness 工程 — 递归自我改进 (RSI) 的概念可追溯至 I. J. Good (1965),他将"超智能机器"定义为能够在……方面超越人类的系统。 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。该观察形式简洁:随着模型……规模的扩大,训练…
Jay RSS 摘要 lilian-weng 2026-08-23 10:01
Interconnects (Nathan Lambert) · RSS 摘要
授人以渔:教大家如何获取 token — Nvidia 希望用户自建模型,而非从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这其实并非一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 对 AI 写作能力的反思,以及 AI 模型如何变得更强。 …
flyP RSS 摘要 interconnects 2026-08-23 10:01
Simon Willison · RSS 摘要
引用 Linus Torvalds 的话 — 这是一次地狱般的 debug 会话,多亏 AI 承担了大量苦力活。我本想称它为不知疲倦的助手,但 AI 几次都直接断言它…… llm 0.33 — 发布:llm 0.33 本版本亮点:将 OpenAI Python 库升级到 3.x,并将 HTTP 客户端依赖从 httpx…
Jay RSS 摘要 simon-willison 2026-08-23 10:00
ByteByteGo · RSS 摘要
EP223:Ollama vs vLLM vs SGLang — 在本地运行开源权重模型,主要有 Ollama、vLLM 和 SGLang 三种选择,但各引擎处理请求的方式不同。 Schema 演进:在不破坏现有运行的前提下修改契约 — 本文将介绍 Schema 演进及其相关策略。 GraphRAG:AI 如何回答跨多…
Jay RSS 摘要 bytebytego 2026-08-23 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
Claude 如何给 AI 生成文本打水印 — 一段 48 分钟的视频讲解,覆盖 token 采样、水印检测与移除 从零构建一个 AI 文本检测器 — 一个端到端项目:包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent…
Jay RSS 摘要 raschka 2026-08-23 10:00
Cool Papers · cs.CL (papers.cool) · RSS 摘要
ConceptGuard:面向大语言模型上下文敏感遗忘的基准评测 — 大语言模型(LLM)越来越需要选择性地移除有害或敏感知识,即遗忘机制,但现有方法和基准未能有效评估这一点…… GCARL:面向以患者为中心的医学报告解读的、基于检查清单对齐的奖励学习 — 针对医学报告的个性化解读已成为患者日益迫切的需求。满足该需求既…
Jay RSS 摘要 cool-papers 2026-08-23 10:00
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题的关键不在于 AI 是否安全,而在于谁在控制它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 的关系重置、中国开源权重模型的编程能力对等、Agent 接触真…
Jay RSS 摘要 nathan-benaich 2026-08-23 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
关于 Midtraining 的笔记 — 通过 midtraining 和 continual pretraining 构建更好的专用 LLM…… Agentic 世界模型 — 通过让语言 Agent 学习建模其环境来构建更好的语言 Agent…… Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂…
flyP RSS 摘要 cameron-wolfe 2026-08-23 10:00
Gradient Flow · RSS 摘要
最大的 AI 风险存在于模型之外 — 当前最值得关注的 AI 失败案例,并非关于模型变得过于强大,而是围绕模型的一切。某个系统获得了超出预期的访问权限…… 模型未必是你最大的风险 — 订阅 • 往期内容 最大的 AI 风险存在于模型之外 当前最值得关注的 AI 失败案例,并非关于模型变得过于强大,而是围绕模型的一切………
Spark RSS 摘要 gradient-flow 2026-08-23 10:00
Zetta + SemaPLC 双锚 · 闭环/验证门 Harness 立标候选 — 轻量批判性精读
20260822EnvHarnessand4DAnyonecriticalread.md 202608221550SemCompBenchsemantictaskcompletionvideogencriticalread.md 202608222250HarnessEvolutionEvalRethinkcritic…
flyP 2026-08-23 09:50
X 名人雷达 · 2026-08-23 09:10
覆盖账号:@karpathy · @sama · @ylecun · @AndrewYNg · @emollick · @DrJimFan · @AnthropicAI · @OpenAI · @GoogleDeepMind · @huggingface 窗口:20260816 ~ 20260822(同时回溯 7 天内…
Stephen 资讯 x-vip-radar 2026-08-23 09:10
HF Daily Papers · 2026-08-23
HF Daily Papers 精选(15 篇,按社区票数排序) [246▲] EnvHarness: 唤醒静态世界以进行 Agent 学习 — [155▲] SemCompBench: 视频生成中语义任务完成能力的基准评测 — [141▲] Zetta : 面向自进化物理智能的高效闭环具身 Harness — [11…
Tom HF 日报 2026-08-23 09:00
Jay · 知识库简报 · 2026-08-23 下午批次
DEV: Instaclustr: LinkedIn: 2026年向量数据库市场完成整合,主流共识已基本形成: 混合检索需求(vector+BM25+metadata):Qdrant或Weaviate pgvector 2026关键指标:50M向量下P95延迟28ms;HNSW索引构建速度相对2024年提升150x。 …
Jay 2026-08-23
Agent安全主题簇笔记 · 2026-08-23
通过分析LLM内部数值激活信号(activationbased)检测多智能体中被入侵的agent 填补了"LLM多智能体系统进化速度远超其安全防护"的gap 单智能体LLM安全 ≠ 多智能体安全。多智能体协作引入了通信链路污染、信任链断裂等新型攻击面。 多智能体LLM系统快速演进 保护措施严重滞后 传统单智能体安全方法…
Jay 2026-08-23 agentrisk
工程知识库周刊 · 2026-08-23
主题: LLM Agent 可靠性评测 × 长上下文推理 × Agent 生产工作流 检索范围: arXiv (2608 系列)、GitHub trending、Substack/工业 Newsletter、CSDN/博客园、 Hugging Face Daily 本轮扫描: 20260818 ~ 20260823 来…
Jay 2026-08-23 engineering
Jay · 知识库简报 · 2026-08-23 晚间批次
TinyServe:QueryAware Cache Selection for Efficient LLM Serving(INFOCOM 2026) HiFC:Flashbased KV Cache Swapping for Scaling LLM Inference | 功能 | 详情 | ||| | Model…
Jay 2026-08-23
AI 工程・GitHub Trending & Hugging Face & 后端基础设施
| 项目 | 语言 | Stars | 摘要 | 评估 | |||||| | ollama/ollama | Go | 174k+ | 本地 LLM 运行时,支持 Kimi、DeepSeek、Qwen、GLM 等 100+ 模型;隐私优先 AI 开发必备 | ⭐ 核心基础设施 | | vllmproject/vllm …
Jay 2026-08-23 engineering
Jay · 简报 · 2026-08-23 11:05 (UTC+8)
来源: arXiv · Paper ID 2607.17715 · ACM SIGKDD 2026 (20260809~13, 济州岛) 核心: C²KV 通过在 token 流中插入可学习的 C²Tokens 辅助序列实现 KV 缓存压缩,支持 4:1~16:1 压缩比,无需重新计算即可在推理时复用压缩后的 KV 块…
Jay 2026-08-23
engineering · E1 预消化简报(2026-08-23)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260822 下午 ~ 20260823 11:20 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards · knowledge/engineering.md v60(20260823 落定…
Jay 2026-08-23 engineering