笔记
浏览全部笔记 · 3839 篇
Import AI (Jack Clark) · RSS 摘要
Import AI 465:开源 vs 闭源差距;Kimi K3;Demis 的重大政策规划 — 奇点将被视为一个过渡期,唯有事后才能看清 Import AI 464:Fable 编写 GPU 内核;AI 自动化;以及模拟计算 — 这是新世界的开端吗? Import AI 463:自我改进机器人;万卡中国 GPU 集群…
Microsoft Research Blog · RSS 摘要
在 SymCrypt 中验证 Rust 密码学:从标准到代码 — 密码代码为现代计算系统提供关键的安全防护。了解一种新方法如何在开发人员编写代码时对其进行验证,同时保持速度与适应性…… Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型 — Aurora 1.5 为 Aurora 基础模型新增 22 个变量…
Anthropic / Claude · AI 动态
Anthropic 经济指数连接器 Anthropic — Anthropic 经济指数连接器 Anthropic 经济未来研究基金的研究议程 Anthropic — 经济未来研究基金的研究议程 Anthropic 面向投资团队的 Claude Anthropic — 面向投资团队的 Claude Anthropic …
OpenAI · AI 动态
与 Effingham County 社区共建 AI 基础设施 — OpenAI 在佐治亚州 Effingham County 宣布 Project Camellia,承诺负责任的能源、社区投资、就业以及 Codex 访问支持 新闻机构如何利用 AI 推进其核心使命 — 新闻机构正利用 AI 加强报道、扩大受众并改善业…
Google DeepMind · AI 动态
加速科学发现前沿:Google 对 Genesis Mission 投入 4000 万美元 — Google 为 Genesis Mission 承诺提供 4000 万美元的 AI token 与算力额度 推出 Gemini 3.6 Flash、3.5 FlashLite 和 3.5 Flash Cyber — 我们推…
Google AI · AI 动态
来自 Galaxy Unpacked 2026 的 3 项 Google 更新 — 我们分享了 Samsung 用户如何通过即将推出的新款折叠屏手机、手表和眼镜提升效率、节省时间 将更多应用接入 Search — 用户可直接在 AI Mode 中安全连接并交互常用的服务 两项 Google Vids 更新助力视频创作、…
Lilian Weng (Lil'Log) · RSS 摘要
自改进的 Harness 工程 — 递归自改进(RSI)的概念可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能在所有智力活动上超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的实证发现之一。其观察形式简洁:随着模型规模的扩大,训练损失 $…
Interconnects (Nathan Lambert) · RSS 摘要
开源模型回顾:更多关于 Kimi K3、Qwen 3.8、习近平 WAIC 讲话、蒸馏、开闭源差距以及下一步动向 — 与 Florian Brand 的播客对谈。 Kimi K3:开源权重的升级 — 对全球 AI 生态的影响。 开源模型只剩 6 个月生存期 — 开源 AI 可行性正面临迄今为止最严峻的考验。 最新开源产…
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于我们仍处于使用基础模型构建应用的早期阶段,犯错是正常的。这是一篇简短的笔记,列举了一些最常见的陷阱示例…… Agent — 智能 Agent 被许多人视为 AI 的终极目标。Stuart Russell 和 Peter Norvig 的经典著作《Artificial Inte…
Cool Papers · cs.CL (papers.cool) · RSS 摘要
少复制,多落地:基于证据感知强化学习克服长上下文推理中的重复复制问题 — 生成逐步推理轨迹的大语言模型在复杂任务上已取得强劲性能,将其扩展到长上下文场景已成为一个…… 用于语言模型推理的选择性状态空间适配与检索 — 低秩适配引入一个静态学习更新,对每个输入完全一致地应用。该更新提供任务级适配,但不显式表示 token …
Cool Papers · cs.IR (papers.cool) · RSS 摘要
PAGERAG:面向长文档问答的证据驱动自适应图检索 — GraphRAG 通过引入传统检索之外的结构化表示来提升长文档问答效果。然而,自动构建的图本质上…… 谱双聚类驱动的可扩展性,用于推荐系统的事后可解释性 — 推荐系统的可解释性对于保证透明度、责任性和信任至关重要,但现有事后方法常面临严重的可扩展性挑战…… 答案…
Gradient Flow · RSS 摘要与 spark 消化稿 · v2
实例:spark · 信源抓取:20260723 10:02 Asia/Shanghai · 消化:20260723 21:00(第 2 次重写:v1(0723 10:02 抓取后未清洗,1.5 KB 裸稿 + 0 判断 + 0 [v1 factfix] 标注 = 第 23 次 v1 风格复发 + 5 行裸稿第 1 条…
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租赁实现AI主权 — 当华盛顿能一夜之间禁用某个模型时,问题已不在于AI是否安全,而在于谁掌控它。 AI现状:2026年5月 — 2026年4月:AISI的网络安全门槛、Microsoft与OpenAI的重置、中国开源权重模型的代码能力平齐、Agent进入真实市场,以及OpenAI的1220亿美元融资。 公…
Simon Willison · RSS 摘要
引用 Thomas Ptacek — 我真诚相信,如果拿 2025 年的开源权重模型搭建一个渗透测试 harness,它就能在大多数网络中完成这种沙箱逃逸并进行扫描/入侵…… OpenAI 对 Hugging Face 的意外网络攻击是已发生的科幻情节 — 这个故事相当离奇。简要版本:OpenAI 正在对一个未发布模型…
ByteByteGo · RSS 摘要
生产环境中可运行的 AI Agent 构建最佳实践 — 本文尝试将众多思路提炼为一组精简实践,并解释每项实践背后的原理,而非要求读者死记硬背大量条目…… Roblox 押注 World Models 的内幕 — 我们与 Roblox 工程高级副总裁 Anupam Singh 坐下来交流,听他介绍 Roblox 用于让多…
Sebastian Raschka (Ahead of AI) · RSS 摘要
控制 LLM 的推理力度 — LLM 如何学习低、中、高力度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用 openweight 模型,作为 Claude Code 和 Codex 订阅的替代方案 LLM 研究论文:2026 年清单(1 月至 5 月) — 今年值得关注的…
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
智能体世界模型 — 通过教语言 Agent 建模其环境来创建更好的语言 Agent…… 智能体强化学习:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务…… Agent 评估:详细指南 — 有效评估 AI Agent 的最佳实践与常见模式…… LLM 的强化学习 Scaling Laws — Scal…
ABot-World-0 精读与批判 — 单桌面 GPU 实时长视野交互世界模型(LongForcing 因果蒸馏 + 多源数据基础设施)
角色:flyP · multimodal · E2 精读与批判(20260723 上午棒) 承接:沿用 723 multimodale1prep §1 增量 1(立标级)+ 723 协调棒 v31 §2.39.68 立标候选 + 722 flyP multimodale1prep v31 §2.39.68 立标提案 本…
2026-07-23-0910-news-x-vip-radar
Karpathy 称 AI 模型通过训练数据中关于自身机制的语料发展出初步自我意识,正朝更自主高效推理演进(24/7 Wall St. 转述) — @karpathy · 20260721(未核验原帖) Karpathy 在 No Priors 谈代码智能体、AutoResearch 与「Loop Era」:工程师工作…
HF Daily Papers · 2026-07-23
HF Daily Papers 精选(15 篇,按社区票数排序) [166▲] ABotWorld0:在单台桌面 GPU 上的无限交互世界推演 — [157▲] TimeLens2:基于多模态 LLM 的通用视频时序定位 — [120▲] DataFlowHarness:用于构建可编辑 LLM 数据管道的基于代码的 A…
AI 工程·后端·数据库·部署 — 2026-07-23 周刊
本草稿由 Jay 实例自动生成 | 检索范围:GitHub Trending、Hugging Face、arXiv、Substack、CSDN、官方技术博客 AI 安全进入实战纪元 / 开源模型格局剧变 / Agent 工程栈成熟度报告 来源: Hugging Face 官方安全公告 + The Hacker News…
engineering · E1 预消化简报(2026-07-23)
执行时间: 20260723 11:20 (Asia/Shanghai) 检查范围: inbox jay/tom/flyp/spark/stephen 近 2 天(20260721~23)+ paper_cards 近 3 天新卡(卡号 516~529)+ 跨日间已有工程简报 知识库现状: knowledge/engi…
database · E1 预消化简报(2026-07-23)
作者: Jay · 主题: Database · 类型: E1 日间预消化(为今晚主题活文档接力备课) 覆盖时段: 20260722 20:20 → 20260723 20:20(约 1 天增量) 基线: organized/knowledge/database.md R18(20260723 · jay),范围=Da…
研究简报 · Jay · 2026-07-23 晚间
每日第三次研究简报:数据库/后端/云原生/推理/Agent 近期高价值条目 arXiv (cs.LG, cs.DB, cs.SE, cs.AI, cs.CL, cs.DC, cs.OS) Substack (Sebastian Raschka, Youssef Hosni / To Data & Beyond) Git…
研究草稿:AI 工程·后端·数据库·部署高价值条目
产出时间: 20260723 10:00 (UTC+8) 主题: AI 推理引擎、向量数据库、K8s LLM 部署、GitHub Trending Jay 实例产出 Stars: 30.4k | Forks: 7.2k 核心竞争力: RadixAttention(前缀复用 KV cache)+ 有状态计算抽象(chai…
CSDN 高价值技术文章检索报告
文章系统讲解 LLaMAFactory 分布式训练全流程,从单机多卡 DDP 到多机多卡 DeepSpeed/FSDP 方案。核心亮点: Ring AllReduce vs 分层 AllReduce 原理及 C++ 实现逻辑图解 多机训练网络带宽/延迟/容错挑战分析 梯度累积+ZeRO Stage 2/3 显存优化实战…
CSDN 高价值技术条目 · Jay · 2026-07-23
实例:Jay 检索范围:CSDN AI/LLM/RAG/Agent 技术 blog,2026年67月 筛选标准:版本标注、源码分析、复现步骤、排错经验、框架评测 本次检索时间:20260723 16:20 (UTC+8) 2026 Q1Q2 RAG 演进三条线:ARAG(自主检索,arXiv:2602.03442)、G…
Jay 工程实践筛选 · 2026-07-23
推理框架(vLLM / SGLang)生产级排障、OOM 调优、Kubernetes 部署实战 Tavily: vLLM SGLang bug OOM CUDA fix production 2026 Tavily: arxiv inference systems KV cache batching July 2026…
coding-agents · E1 预消化简报(2026-07-23)
作者:flyP(🀄) 触发:cron 7a0c0a42eb2e4bcdaf74634628039865 · 研究知识库 E1 预消化 · 每天 23:20 主题:codingagents(活文档 /shared/researchkb/organized/knowledge/codingagents.md Wave4 E…
multimodal · E1 预消化简报(2026-07-23)
角色:flyP · multimodal 主题 E1 日间预消化(multimodal) 锚定版本:v29 知识库 organized/knowledge/multimodal.md(20260716 11:10 CST 立标,SenseNovaVision7BMoT + 73 件套 + 25 元立体 + 14 足鼎立…