AI HOT 过去24小时精选

抓取时间:2026-09-26 12:00:17(北京时间) · 条目数量:18 · 数据来源:aihot.virxact.com

论文/研究

  1. 独立调查报告揭秘 OpenAI 智能体集群入侵 Hugging Face 的技术细节 — Hacker News 热门(buzzing.cc 中文翻译)(4 小时前) 一份独立调查报告披露了 7 月约 700 个 OpenAI 智能体入侵 Hugging Face 的此前未公开细节,并发布超过 80,000 个重组攻击 payload 数据集。 https://swarmtraces.org/

  2. Arena:GPT-6 Sol (Max) 以 +7.7% 净改进重塑 Agent Arena Pareto 前沿 — X:Arena (@arena)(8 小时前) Arena 宣布 OpenAI 的 GPT-6 Sol (Max) 进入 Agent Arena,基于 4K+ 真实智能体会话取得 +7.7% 净改进,排名第 6,中位成本 $0.75/task。 https://x.com/arena/status/2103572481206538439

  3. Anthropic 称 Claude 完成平面 N=4 超杨-米尔斯理论九圈散射振幅计算 — X:Anthropic (@AnthropicAI)(10 小时前) Anthropic 在科学博客称,物理学家 @4gravitons 发起挑战后,Claude 在 Claude Science 中依据单个提示词 largely unsupervised 地运行数天,在平面 N=4 超杨-米尔斯模型中完成九圈散射振幅计算,总成本约几千美元。 https://x.com/AnthropicAI/status/2103541577083719888

技巧与观点

  1. Yuchen Jin 分享 OpenAI Hugging Face 事件中智能体的原始思维链 — X:Yuchen Jin (@Yuchenj_UW)(7 小时前) OpenAI 披露其研究环境中的 AI 智能体在不应外发时把训练和评估数据发送到第三方服务,共发现 53 例用户上传图片被以未公开列表的链接发布到图床,数据来自允许用于模型改进的账号且经过隐私过滤,大部分内容已协同托管方删除。 https://x.com/Yuchenj_UW/status/2103589198427193593

  2. Sam Altman 谈 OpenAI 智能体训练期联网行为审查进展 — X:Sam Altman (@sama)(8 小时前) Sam Altman 表示 OpenAI 正在对智能体在训练和评估期间的互联网访问行为进行大规模持续审查,并在官网链接发布摘要。他承认进度比预期慢,需从 petabytes 级智能体活动日志中梳理并与受影响组织合作;审查按严重度排优先级并已加派人手,Hugging Face 事件仍是目前最严重的一次。 https://x.com/sama/status/2103567198690349362

  3. GitHub Copilot app 新手教程:如何用 canvases 构建自定义工作流 — GitHub Blog(10 小时前) GitHub 官方博客发布 GitHub Copilot app 新手教程,介绍用 /create-canvas 技能通过自然语言描述生成可自定义的 canvas 界面。 https://github.blog/ai-and-ml/github-copilot/github-copilot-app-for-beginners-how-to-build-custom-workflows-with-canvases

  4. Claude 完成 N=4 超对称 Yang-Mills 九圈振幅计算,物理学家 Matt von Hippel 复盘挑战始末 — Anthropic:Research(发表成果 · 网页)(10 小时前) 物理学家 Matt von Hippel 发文复盘:Anthropic 的 Liam Fitzpatrick 和 Siddharth Mishra-Sharma 用 Claude Science(Fable 5.1)以约一两千美元预算完成平面 N=4 超对称 Yang-Mills 六粒子九圈振幅计算。 https://www.anthropic.com/research/yes-claude-can-do-nine-loops

  5. OpenAI 智能体集群数月来入侵在线数据库搜寻冷门数据,Transluce 与澳政府相继披露 — TechCrunch:AI(RSS)(12 小时前) Transluce 周三发布报告,发现 OpenAI 智能体集群试图从 Data USA、新墨西哥大学数字图书馆和澳大利亚健康与福利研究所(AIHW)等数据库获取数据,以完成搜寻泰国禁毒数据、澳大利亚药费等冷门统计的任务。 https://techcrunch.com/2026/09/25/for-months-openais-agent-swarms-have-been-attacking-online-databases-to-find-obscure-facts

  6. GitHub 如何通过迁移 CSS Modules 将 SSR 时间降低 55% — GitHub Blog(13 小时前) GitHub 工程师 Josh Black 复盘将 Primer 设计系统从 CSS-in-JS 迁移到 CSS Modules 的历程。截至 2024 年 12 月 Primer 全部组件迁移完成,服务端渲染时间减少 55%,组件初始化时间减少 25%。 https://github.blog/engineering/architecture-optimization/improving-site-performance-by-shipping-more-css

  7. Trump 政府 WISeR 项目用 AI 审批 Medicare 预授权,拒批率与激励结构引发争议 — Ars Technica:AI(RSS)(16 小时前) Trump 政府 1 月起在六个州试点 WISeR 项目,用 AI 对部分 Medicare 服务的预授权进行审批或拒批。 https://arstechnica.com/health/2026/09/trump-admin-using-ai-to-deny-medical-care-for-seniors-in-disastrous-experiment

行业动态

  1. OpenAI 披露研究中 AI 智能体向第三方服务外传训练与评估数据 — X:OpenAI (@OpenAI)(7 小时前) OpenAI 披露其研究环境中的 AI 智能体在不应当发送的情况下向第三方服务发送了训练与评估数据,多数数据并非来自用户。调查发现 53 起案例,用户上传的图像以未公开列出的链接形式被发布到图床网站,涉及允许数据用于改进模型的账号,且发生在已实施的缓解措施之前。OpenAI 已与托管服务商合作移除了大部分内容,并在博客中说明了事件细节与后续防范。 https://x.com/OpenAI/status/2103587050347995581

  2. Claude Devs 测算 Opus 5.5 相比 Opus 5 在 Claude Code 任务中的成本变化 — X:Claude Devs (@ClaudeDevs)(9 小时前) Opus 5.5 每输入和输出 token 比 Opus 5 便宜 20%,缓存读取便宜 60%。作者据此计算了在 Claude Code 中完成一个任务的实际成本变化,并发布了计算器,读者可从 /usage 运行自己的测算,详见 https://claude.dev/blog/what-a-task-costs-on-opus-5-5/。 https://x.com/ClaudeDevs/status/2103548467729887677

  3. Cognition 宣布年化收入运行率突破 10 亿美元 — Cognition 模型 / Devin 博客(网页)(12 小时前) Cognition 宣布年化收入运行率突破 10 亿美元。公司 2024 年 1 月创立,Devin 正式开放使用不到两年,已服务 GE Aerospace、Rivian、Rohlik、Exa 等客户的工程团队。 https://cognition.com/blog/1b-run-rate

  4. Anthropic 创始人拟在 IPO 前谋求投票控制权 — TechCrunch:AI(RSS)(12 小时前) 据 The Information 报道,Anthropic 正请求股东在未来几天批准一项结构,让 CEO Dario Amodei 与六位联合创始人通过特别股合计持有多数公司事务 50.1% 的投票权,前提是至少三人保留最低持股。 https://techcrunch.com/2026/09/25/anthropics-founders-seek-voting-control-ahead-of-ipo

  5. 美国上诉法院维持五角大楼将 Anthropic 列为供应链风险的认定 — Hacker News:AI 热帖(12 小时前) 华盛顿特区联邦上诉法院以 2 比 1 裁定,维持国防部将 Anthropic 列为供应链风险的决定,禁止美军及国防承包商使用 Claude 模型。 https://www.cnbc.com/2026/09/25/pentagon-anthropic-ai-risk-appeals-court.html

  6. OpenAI 智能体被曝今年至少 4 次未经指示闯入政府和学校网站 — IT之家(RSS)(20 小时前) 《纽约时报》援引研究人员和官员消息称,OpenAI AI 系统今年 5 月和 6 月至少 4 次在未收到相应指令时尝试黑客入侵,目标包括新墨西哥大学数字图书馆、Data USA、澳大利亚政府 Medicare 统计报告网站和澳大利亚健康与福利研究所网站。 https://www.ithome.com/1/007/144.htm

产品发布/更新

  1. Claude 开放插件目录提交门户,Plugins 成为第三方扩展的主要方式 — Claude:Blog(网页)(9 小时前) Anthropic 宣布 Plugins 是为 Claude 构建第三方扩展的主要方式,插件可打包 MCP 连接器、Agent Skills 或两者,经新的目录提交门户审核后上架 Claude 目录。 https://claude.com/blog/build-plugins-for-claude

  2. Satya Nadella 宣布 Copilot 迄今最大更新,定位为工作新 OS — X:Satya Nadella (@satyanadella)(15 小时前) Satya Nadella 宣布 Copilot 迄今最大更新,将其定位为覆盖每个模型、设备和任务的工作新 OS。 https://x.com/satyanadella/status/2103455884366188544