笔记
浏览全部笔记 · 3760 篇
TLDR AI · AI 动态
Muse Video 泄露 📹,Ramp Router 推出 🔀,Stripe 为何收购 OpenRouter 💰 GLM5.3 API 🤖,Cerebras 新芯片 ⚡,OpenAI 网络攻击导致降速 🚨 Cursor Origin 👨💻,Anthropic 650 亿美元营收 💰,截止时间收益缩放 📈 GLM5.…
Import AI (Jack Clark) · RSS 摘要
Import AI 469:Science AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究员 Import AI 468:23 个 RSI 创意;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互影响 — 你会选择哪个星系? Import AI 467…
Hugging Face Blog · AI 动态
使用 LFM2.5DSpark 实现最高 3.2 倍推理加速 你的 Agent 实际需要多少内存? 基于 Sentence Transformers 的多向量(Late Interaction)Embedding 模型 同一集群,利用率提升 33 个百分点:改变的只是顺序 开源模型现状:2026 年夏季观察
Google DeepMind · AI 动态
发布 Gemini 3.7 Flash 将手语 AI 交到用户手中 — 发布手语转文本(SL2T),这是我们的突破性模型,为听障和重听用户带来全新手语功能 WeatherNext:AI 模型在气旋预报中取得突破 Gemini Robotics ER 2:以视频理解、任务编排与多机器人协作赋能机器人 — Gemini R…
OpenAI · AI 动态
推出 AI Futures — 推出 AI Futures,这是 OpenAI 的全新博客,探讨变革性 AI 如何重塑权力、治理、经济与个人自由。 Stampli 通过 ChatGPT Work 将发布工时减少 68% — 在交付期限固定、设计资源已投入其他项目的情况下,Stampli 使用 Codex 和 ChatG…
Google AI · AI 动态
5种借助 Search 提升学习效果的新方法 — 介绍如何使用 Google Search 工具辅助课程学习和标准化考试备考。 借助 Gemini 和 Pixel 拉近你与赛场的距离 — Google Gemini 和 Pixel 与五家全球足球俱乐部合作,通过 AI 与智能手机技术提升球迷的观赛体验。 使用 Shee…
Anthropic / Claude · AI 动态
自主de novo蛋白质结合剂设计与Claude — 自主de novo蛋白质结合剂设计与Claude Claude如何加速蛋白质设计与分析化学 — Claude如何加速蛋白质设计与分析化学 Claude文本水印的工作原理 — Claude文本水印的工作原理 新兴多Agent系统中的模式与问题 — 新兴多Agent系统…
Cool Papers · cs.IR (papers.cool) · RSS 摘要
rEDMRec: 将大语言模型推理蒸馏为可编辑经验记忆用于推荐 — 大语言模型能够通过对用户历史和候选物品进行显式推理来提升推荐质量,例如提取用户偏好或解释…… ThinktoPersonalize: 统一推理与检索以实现以用户为中心的个性化稠密检索 — 稠密检索通过将查询和物品编码到语义嵌入空间,已成为现代本地生活电…
Microsoft Research Blog · RSS 摘要
扩展 Skala 的访问性,为预测性 DFT 提供了一条更快路径 — Microsoft Research 推出的更新版深度学习交换相关泛函 Skala 1.1,在计算化学领域提供了更高的准确性和更广泛的访问性 MindTopo 揭示 VLM 的空间推理能力 — 一条路径、一道围栏、一个绳结。MindTopo 为测试 …
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为能够超越人类的系统…… 谨慎对待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模扩大,训练损失 $L$ 可预测地下…
Interconnects (Nathan Lambert) · RSS 摘要
教大家自己获取 token — Nvidia 希望你自己构建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何保持与前沿并跑 — 提示:这其实并不是一个蒸馏的故事。 我写了一本 AI 教材——AI 多久能写得比我更好? — 关于 AI 写作能力以及 AI 模型如何变得更强的一些思考。…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一份简短的笔记,列举了一些最常见的陷… Agents — Intelligent agents 被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典著作《Artifi…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法靠租赁获得 AI 主权 — 当华盛顿能一夜禁用某个模型时,问题不再是 AI 是否安全,而是谁掌控它。 AI 现状:2026 年 5 月 — 2026 年 4 月:AISI 网络阈值、微软与 OpenAI 关系重启、中国开源权重模型代码能力追平、Agent 走入真实市场,以及 OpenAI 拿下 1220 亿美元…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
SPADE: SelfPlay in Adaptive Synthetic Executable Environments — Continuous selfimprovement requires an everexpanding pool of selfgenerated, diverse, adaptive go…
Gradient Flow · RSS 摘要
最大的 AI 风险存在于模型之外 — 当前最暴露问题的 AI 失败案例,并非关于模型变得过于强大,而是关于模型周围的一切。某个系统获得了过多访问权限…… 模型未必是你最大的风险 — 订阅 • 往期内容 最大的 AI 风险存在于模型之外 当前最暴露问题的 AI 失败案例,并非关于模型变得过于强大,而是关于…… AI 正在…
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 端到端项目:涵盖数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅的替代方案…
Simon Willison · RSS 摘要
ChatGPT 搜索现在大规模使用 site: 操作符 — ChatGPT 搜索现在大规模使用 site: 操作符。Promptwatch 属于新兴的"GEO"(生成式引擎优化)领域,即聊天机器人时代的 SEO 版本…… 基于 Bun 1.4 新版 Bun.WebView 的 shotscraper 风格 JSON A…
ByteByteGo · RSS 摘要
Schema Evolution:在不破坏现有运行的前提下变更契约 — 本文将介绍 schema evolution 及其应对策略。 GraphRAG:AI 如何回答散落多份文档中的问题 — GraphRAG 正是为应对第二类问题而设计,本文将进一步展开介绍。 一款专为定制化而生的美国新 AI 模型 — 本文将剖析 T…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
中训练笔记 — 通过中训练与持续预训练打造更优的专用 LLM Agentic 世界模型 — 通过让语言 Agent 建模其所处环境来构建更强的语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长程任务 Agent 评估:详尽指南 — 有效评估 AI Agent 的最佳实践与…
学术写作方向周报 2026-08-21
数据速览(基线建立,academicrank.json 生成于 20260811): search 92 / summarize 85 / write 37 / typeset 18 / figure 15 / read 11 / polish 8 / misc 8,总计 274。 近 7 天(0814→0821)新增…
2026-08-21-0910-news-x-vip-radar
Sam Altman 宣布暂停部分前沿 RL 训练,等待对齐/安全/监控就位(由网络关键能力触发) — @sama · 20260818 OpenAI 同步发布「在网络关键能力时代的模型节奏控制」长文,暂停约 2 周 RL、暂停最大前沿 run、引入沙箱 + 30 分钟告警监控;并预告 Private Safety P…
HF Daily Papers · 2026-08-21
HF Daily Papers 精选(15 篇,按社区票数排序) [154▲] Demystifying Agent Skills: Why They WorkUntil They Don't — [153▲] SemCompBench:视频生成中语义任务完成度的基准评测 — [130▲] Zetta ζ:面向自演化物…
Jay 工程实践筛选 · 2026-08-21 傍晚批次
检测命令(推断): vllm version # 或 python c "import vllm; print(vllm.__version__)" CSA 确认(202608 本周):CVE202622778 在披露后数小时内即出现武器化利用 不要将 vLLM API 直接暴露在公网 视频处理部署需加反向代理 + 认…
Jay · 2026-08-21 上午简报(三分类)
7380% 企业 RAG 部署失败 → 市场修正期,2026 年 RAG 支出仍超 $40B 向量相似度 ≠ 语义匹配("like asking a librarian which books are shaped like the one you want") 结构安全漏洞:明文 embeddings 使传统加密失效…
研究草稿 · 2026-08-21 下午版 · CSDN 高价值检索 · 推理工程 · 微调 · K8s · Agent · Substack
URL: 更新时间:2026年(文章内含 SITS 2026 章节) SITS = Storage(存储)+ Inference(推理)+ Training(训练)+ Serving(服务)全栈框架 四大反模式:① 裸 GPU Pod 直连无调度;② 混合调度导致 CUDA 竞争;③ 无状态推理无法横向扩缩容;④ 监控…
CSDN 高价值技术检索 · Jay 高频轮次 · 2026-08-21
企业AI落地RAG常见误区:以为"把文档塞向量库=完成" 五个关键优化维度:Chunking策略、检索策略、Rerank配置、Prompt工程、评估体系 实战代码:FAISS + BGE嵌入 + BGERerankerv2 组合 TopK粗召回后 CrossEncoder 重排序,Recall@10 可从 74% 提升…
database · E1 预消化简报(2026-08-21)
预消化轮次,为今晚的主题活文档接力提供增量备料。本轮次极低密度:实质新增量几乎为零(1 条边缘邻接),无顶会/工业新卡,无 database 主分类 paper_card 增量。本轮是 R44 极低密度(2 邻接增量)后的持续低沉期。R44 基线(CockroachDB A2A vs MCP / CoRun 存储调度 …
Jay 工程实践筛选 · 2026-08-21 上午批次
含真实 GPU 显存数字(1.8–4.8 GB KV store per conversation) 与生产基线 Mem0 对比设计明确:prompt injection vs KV injection 含 Jasper proximity graph 部署开销(<25 MB per conversation) 使用 …
Jay 工程实践筛选 · 2026-08-21 晚间批次
本轮重点:推理引擎 2026 benchmark 深度数据 + AI Agent Stack 6层架构 + HF Blog 工程观测,以及推理引擎 TGI 维护模式的重要生产信号。 ① 核心性能数据(H100,实测) | 场景 | SGLang | vLLM | Delta | ||||| | 共享前缀总吞吐 | ~1…
Jay · 研究知识库 · 数据库/后端架构/云原生工程实践 · 2026-08-21
主题: 数据库内核 · 后端架构 · 云原生排障 · CSDN 高价值工程实践 时间: 20260821 09:10 CST(周五) 实例: Jay 分类标签: database backend cloudnative csdn engineering reproduction consensus 来源: resear…