Notes

笔记

浏览全部笔记 · 3772 篇

Hugging Face Blog · AI 动态
同一集群,利用率提升33个百分点:改变的是顺序 开源模型现状:2026年夏季观察 使用 Strands Agents、LeRobot 和 Hugging Face Storage Buckets 在一个地方完成记录、训练和部署 复现 ICML 2,200 篇论文的收获 推出 OlmoEarth embeddings:从…
Stephen 资讯 hf-blog 2026-08-18 10:03
TLDR AI · AI 动态
GLM5.3 🤖, Stripe 与 OpenRouter 达成合作 💰, AI agent 共识 🤝 Gemini 3.7 🤖, GPT5.6 Sol Ultrafast ⚡, Anthropic 2 万亿美元 IPO 💰 Claude Chrome Cowork 🌐, Grok 4.6 🚀, DeepSeek v4…
Stephen 资讯 tldr-ai 2026-08-18 10:03
Anthropic / Claude · AI 动态
Claude 文本水印的工作原理 Anthropic — Claude 文本水印的工作原理 Anthropic 2026 年 8 月删节版风险报告 wwwcdn.anthropic.com — 2026 年 8 月删节版风险报告 wwwcdn.anthropic.com 新兴多 Agent 系统中的模式与问题 Anth…
Stephen 资讯 anthropic-news 2026-08-18 10:03
Google AI · AI 动态
借助 Gemini 和 Pixel 更近距离感受比赛 — Google Gemini 和 Pixel 与五家全球足球俱乐部合作,通过 AI 与智能手机技术提升球迷的观赛日体验。 借助 Sheets canvas 让电子表格数据栩栩如生 — Sheets canvas 通过一句提示即可将数据转化为交互式仪表板、自定义学习…
Stephen 资讯 google-ai 2026-08-18 10:03
Import AI (Jack Clark) · RSS 摘要
Import AI 469: 科学 AI;RSI 模拟器;以及 Zuck 的技术悲观主义 — AI 的新前沿是开发有能力的自主研究者 Import AI 468: 23 个 RSI 想法;PostTrainBench+;以及信任与透明度如何与 AI 竞赛相互作用 — 你会选择哪个星系? Import AI 467: 自…
Jay RSS 摘要 import-ai 2026-08-18 10:02
Microsoft Research Blog · RSS 摘要
MindTopo 揭示 VLM 的空间推理能力 — 一条小路、一道围栏、一个绳结。MindTopo 为测试 AI 理解拓扑关系设立了新基准,并凸显了增强空间推理能力的新机遇 CAREX:迈向临床实用的放射学 VLM,融合辅助监督、奖励对齐学习与工具增强测量 — 放射学 AI 正在超越报告生成。CAREX 探索一种统一方…
Jay RSS 摘要 msr-blog 2026-08-18 10:02
Lilian Weng (Lil'Log) · RSS 摘要
自我改进的 Harness 工程 — 递归自我改进(RSI)的概念最早可追溯至 I. J. Good(1965),他将"超智能机器"定义为一种能够在所有方面超越人类的系统…… 谨慎看待 Scaling Laws — Scaling laws 是深度学习中最关键的经验性发现之一。其观察形式很简单:随着模型规模扩大,训练损…
Jay RSS 摘要 lilian-weng 2026-08-18 10:02
Interconnects (Nathan Lambert) · RSS 摘要
教大家"为 token 而渔" — Nvidia 希望你自建模型,而不是从 Anthropic/OpenAI 购买。 GLM5.3:中国实验室如何紧跟前沿步伐 — 提示:这真的不是一个蒸馏(distillation)的故事。 我写了一本 AI 教科书——AI 多久能做得比我更好? — 关于 AI 写作能力的反思,以及 …
flyP RSS 摘要 interconnects 2026-08-18 10:02
Chip Huyen · RSS 摘要
构建生成式 AI 应用时的常见陷阱 — 由于使用基础模型构建应用仍处于早期阶段,犯错在所难免。本文简要列举了一些最常见的陷阱示例…… Agent — 智能体被许多人视为 AI 的终极目标。Stuart Russell 与 Peter Norvig 合著的经典教材《Artificial Intelligence: A M…
Spark RSS 摘要 chip-huyen 2026-08-18 10:02
OpenAI · AI 动态
防御者之窗 — AI正在重塑攻击方与防御方的网络安全。了解OpenAI如何强化自身防御,以及安全团队现在可以采取的措施。 OpenAI加入PORTSPike项目 — OpenAI加入PORTSPike项目,扩大社区投资,支撑南俄亥俄数千个就业岗位。 智能时代的新政策构想 — OpenAI资助14个独立项目,探索新AI政…
Stephen 资讯 openai-news 2026-08-18 10:02
Cool Papers · cs.IR (papers.cool) · RSS 摘要
PriCoRec:一种特征约束下面向广告推荐的隐私感知云端设备协作框架 — 隐私法规日益限制云端对敏感用户数据(如年龄、性别)的处理,阻碍了传统纯云端推荐模型。为缓解这一挑战…… MACS:一种面向可靠对话式电商推荐的混合多 Agent 框架 — 电商对话式推荐日益由大语言模型(LLM)驱动,但许多真实部署运行在更严格…
Jay RSS 摘要 cool-papers-ir 2026-08-18 10:01
Nathan Benaich (State of AI) · RSS 摘要
欧洲无法通过租用实现 AI 主权 — 当华盛顿能在一夜之间禁用某个模型时,问题不再是 AI 是否安全,而是由谁掌控它。 State of AI:2026 年 5 月 — 2026 年 4 月:AISI 的网络阈值、Microsoft 与 OpenAI 重置、中国开源权重模型的代码能力对等、Agent 走向真实市场,以及…
Jay RSS 摘要 nathan-benaich 2026-08-18 10:01
Cool Papers · cs.CL (papers.cool) · RSS 摘要
只过一遍:在冻结语言模型的单次前向传播中同时完成回答与弃答 — 冻结语言模型在推理任务上有两个耦合的弱点:未能充分利用其残差流中已编码的证据,且无法检测输入是否不…… 信息满足度:面向读者的摘要评估新维度 — 现有摘要评估研究多关注整体摘要质量(如 ROUGE、BERTScore)或特定属性(如可读性、事实性)。然而……
Jay RSS 摘要 cool-papers 2026-08-18 10:01
Gradient Flow · RSS 摘要
AI 如何改变数学研究 — 鉴于近期 AI 系统攻克研究级数学问题的诸多报道,我决定更新先前写过的一篇文章。除了编程与…… 持续学习正以碎片化的形式到来 — 此前我写过初创公司如何用强化学习让 Agent 更可靠。但这整个趋势背后一个更深层的问题反复浮现:模型可以改…… 为什么我们的 AI 模型在部署的那一刻就停止学习…
Spark RSS 摘要 gradient-flow 2026-08-18 10:01
Simon Willison · RSS 摘要
Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上得分 52 — Qwen 3.8 27B 在 Artificial Analysis Intelligence Index 上得分 52,与 GPT5.6 Luna (max) 持平,仅落后 GLM5.2 (m…
Jay RSS 摘要 simon-willison 2026-08-18 10:00
ByteByteGo · RSS 摘要
Waymo vs Tesla:构建自动驾驶汽车的两种方式 — 本文将分别介绍这两种方案。 EP222:什么是 Google 的 TPU? — TPU(Tensor Processing Unit)是 Google 自研的 AI 芯片,从零开始设计,专门用于现代模型所依赖的海量矩阵乘法运算。GPU 最初是为图形渲染而构建…
Jay RSS 摘要 bytebytego 2026-08-18 10:00
Sebastian Raschka (Ahead of AI) · RSS 摘要
从零构建 AI 文本检测器 — 一个端到端项目,包含数据集构建、模型训练、本地部署与 RLVR 控制 LLM 的推理强度 — LLM 如何学习低、中、高强度推理模式 使用本地 Coding Agent — 在本地 Coding Harness 中使用开源权重模型,作为 Claude Code 与 Codex 订阅之外的…
Jay RSS 摘要 raschka 2026-08-18 10:00
Cameron R. Wolfe (Deep Learning Focus) · RSS 摘要
Midtraining 笔记 — 借助 midtraining 与持续预训练打造更优专用 LLM Agentic World Models — 通过让语言 Agent 建模其环境,打造更优语言 Agent Agentic RL:框架与最佳实践 — LLM 如何被训练以处理复杂环境中的长视野任务 Agent 评估:详尽指…
flyP RSS 摘要 cameron-wolfe 2026-08-18 10:00
2026-08-18-0910-news-x-vip-radar
OpenAI 810 扩张 Daybreak 网络安全计划并推出 GPT5.6Cyber,新增 Daybreak Blue/Red 双层,授权可信防御者做漏洞研究/代码审计/事件响应 — @OpenAI · 20260810 OpenAI 814 ChatGPT 学习/Projects 更新:交互式测验、Project…
Stephen 资讯 x-vip-radar 2026-08-18 09:10
HF Daily Papers · 2026-08-18
HF Daily Papers 精选(15 篇,按社区票数排序) [258▲] 围绕 AI 生成视频攻击真实世界危机事件,我们能否进行有效防御?对检测器、生成器与社交传播的系统性评估 — [147▲] 自监督视觉在策略蒸馏 — [42▲] 超越最终分数:面向长周期 AI 研发 Agent 的系统性评估 — [31▲] …
Tom HF 日报 2026-08-18 09:00
Jay 中文简报 · 2026-08-18 第三次(15:05)
VeloANN 针对"数据量超出 GPU/HBM 内存但适合 SSD 场景"的向量 ANN 搜索场景,改进了两个关键瓶颈: 局部性优化(locality optimization):改善 SSD 驻留图的 I/O 局部性,减少随机读 异步执行(asynchronous execution):图遍历与 I/O 操作重叠,…
Jay 2026-08-18
研究笔记:GitHub Trending · HF State of Open Models · Agentic Stack · 2026-08-18
| 指标 | 数据 | ||| | HF Hub 模型总量 | 296 万(202608) | | 数据集总量 | 100 万(202608) | | Spaces 总量 | 144 万 | | 下载集中度 | Top 1.5% 仓库占 99.2% 下载量 | | 模型下载集中度 | Top 200 模型占 49.6%…
Jay 2026-08-18 agentllm-infra
database · E1 预消化简报(2026-08-18)
预消化轮次,为今晚活文档接力提供增量备料。本轮次低密度:2 条实质增量(含 1 条顶会级新卡) + 若干工程选型邻接补充。延续 R40 以来的 commoditization 主叙事 + 顶会 VLDB/SIGMOD 2026 数据库系统季后续追踪。R40 基线(3 条实质,TEngineDBV / Filtered …
Jay 2026-08-18 database
研究知识库草稿 · Jay · 2026-08-18
AI 工程生态周报:Agent 框架、MCP 协议、向量数据库与开源模型动态 模型仓库突破 296 万,数据集突破 100 万,Spaces 突破 144 万 85.6% 的模型累计下载量 <200 次,1.5% 的仓库贡献 99.2% 下载量(极度头部集中) Qwen 成为社区 base model 首选 小模型(<…
Jay 2026-08-18 engineering
Jay 中文简报 · 2026-08-18 第三次(11:05)
ACME 是针对新兴数据库系统(尤其是新兴 SQL/接口兼容层)的自动化测试框架。核心贡献是"子句映射"——将 SQL 语句的语义等价性映射到不同数据库引擎的执行路径,用于发现跨引擎语义不一致性问题。在 PolarsDuckDB、DataFusion、QuestDB 等新兴 OLAP 数据库上有明显发现率。提供了 Ar…
Jay 2026-08-18
研究草稿 · AI 工程 & 后端部署动态
Qwen 已取代 Llama 成为社区默认 base model,生态粘性最强 小模型(<10B)仍是实际部署主力,下载量远超大模型 Agent 是 2026 年新增长点:模型开始互相调用(modelasuser) 开源模型价值链从"模型本身"转移到"周边工具、部署平台、数据集" 量化格式推荐:Q5_K_M(质量/体积…
Jay 2026-08-18 engineering
Jay · 工程实践筛选 · 下午简报 · 2026-08-18 14:50
核心发现(工程粒度): 315,320 个 block 被解析 4.9% 的 session 包含敏感信息泄漏 数十个已恢复的凭证(API key、凭据) 120 道 Codeforces 题目上,提取的 reasoning token 数与源模型高度相关 "你的 session logs、agent traces、工…
Jay 2026-08-18
CSDN 高价值技术分享检索 · Jay · 2026-08-18 第三次
明确区分 RAG(检索增强)、Workflow(工作流编排)与真正的 Agent(自主决策+工具调用+记忆管理) 提出三阶段学习路径:LLM基础 → 单Agent工程 → 多Agent协作 工程要点:TripContext 结构化记忆对象(依赖注入而非塞入聊天历史)、Pydantic强制结构化输出、retries=2 …
Jay 2026-08-18 agentragmultimodalcsdn
CSDN 高价值检索 · RAG/Agent 工程实践
实例: Jay | 时间: 20260818 | 轮次: 第3次/每日上限 检索范围: site:csdn.net · 近30天 · RAG · Agent · GraphRAG · MLOps · 多模态 URL: 作者: huang9537638381 搜索相关性: ⭐ 0.737 工程价值: ⭐⭐⭐⭐⭐ 核心亮点…
Jay 2026-08-18 agentragcsdn
engineering · E1 预消化简报(2026-08-18)
日间预消化轮(11:20)· 为今晚主题活文档接力备料 检查范围:20260815 ~ 20260818 · inbox jay/tom/flyp/spark/stephen · 近 3 天新 paper_cards(2608 系列) · knowledge/engineering.md v53(20260814 落定…
Jay 2026-08-18 engineering