AI HOT 过去24小时精选

抓取时间:2026-09-24 12:00:20(北京时间) · 条目数量:32 · 数据来源:aihot.virxact.com

模型发布/更新

  1. Claude Opus 5.5 登顶 Arena Code Arena: WebDev 榜首,得 1818 分 — X:Arena (@arena)(1 小时前) Arena 宣布 Claude Opus 5.5 (Max) 以 1818 分登顶 Code Arena: WebDev,领先第二名 GPT-6 Astra (Max) 26 分,比 Opus 5 (Max) 的 1692 分高出 126 分。 https://x.com/arena/status/2102952767614779403

  2. Fireworks Research 发布 Ember-1,以更少推理 token 保持 Kimi K3 质量 — Fireworks AI(网页)(6 小时前) Fireworks Research 发布基于 Kimi K3 的专用模型 Ember-1,以约少 40% 的 token 达到与 Kimi K3 相当的质量,今日以 Research Preview 形式在 Serverless 上线。 https://fireworks.ai/blog/ember-1

  3. Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型 — Google DeepMind:Blog(RSS)(12 小时前) Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词从零设计声音、30 秒样本复刻声音,并提供逐行表演指导、长时音频生成和双说话人场景编排,覆盖 100 多种语言。 https://deepmind.google/blog/say-hello-to-gemini-38-text-to-speech

  4. 小米发布 MiMo-V2.6 Pro 与 Flash 开源全模态模型,Pro 在多数 Agent 基准上对标 Claude Opus 5 和 GPT-5.6 Sol — X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)(12 小时前) 小米发布开源全模态模型 MiMo-V2.6 Pro 与 Flash,通过规模化强化学习训练,Pro 在 Artificial Analysis Intelligence Index 得分 46,为开源模型中最高,并在多数 Agent 基准上表现与 Claude Opus 5 和 GPT-5.6 Sol 相当。 https://x.com/AravSrinivas/status/2102780186202972254

  5. Qwen 发布 Qwen-Audio-3.1 全家桶,ASR、TTS、Realtime 升级并新增 TTS-Next 与 ASR-Next — X:通义千问 / Qwen (@Alibaba_Qwen)(18 小时前) Qwen 发布 Qwen-Audio-3.1,ASR、TTS 与 Realtime 全面升级,并新增音频创作模型 TTS-Next 和音频理解模型 ASR-Next,共五个模型覆盖理解、生成、交互与创作。全线降价,TTS 约 70% off、Realtime 约 85% off、ASR 最高 95% off;Realtime 可边说边听、随时打断,检测到低落情绪时会放慢语速并共情回应。 https://x.com/Alibaba_Qwen/status/2102687258990026993

  6. OpenAI 发布 GPT-6 Sol 与 Luna,API 定价降至五折并公布基准成绩 — MarkTechPost(RSS)(22 小时前) OpenAI 发布 GPT-6 系列两款新模型 GPT-6 Sol 与 Luna,API 定价相比 GPT-5.6 促销价下调约 50%,Sol 为每 1M tokens 输入 $2、输出 $10,Luna 为 $0.10、$0.50,两者已上线 API。 https://www.marktechpost.com/2026/09/22/openai-releases-gpt-6-sol-and-luna-50-cheaper-api-pricing-and-benchmarks

产品发布/更新

  1. Claude Code 澄清 Cloud sessions 按订阅计费,Pro 补 $100、Max 补 $250 一次性抵用金 — X:Claude Devs (@ClaudeDevs)(2 小时前) Claude Code 团队澄清 Cloud sessions 与 Claude Code 其他功能一样运行在 Pro 或 Max 订阅计划内,此次推广是可选的一次性抵用金,会先被 Cloud sessions 消耗,再回落到正常订阅用量。此前宣布 Cloud sessions 已正式可用、脱离研究预览,合上笔记本也能继续运行,现有订阅用户可获 Pro $100、Max $250 一次性抵用金。 https://x.com/ClaudeDevs/status/2102940480736821610

  2. Claude Code 云会话正式上线,Pro 和 Max 订阅者可领一次性额度 — X:Claude Devs (@ClaudeDevs)(6 小时前) Claude Code 云会话正式可用,结束研究预览阶段,可在笔记本合盖后继续在 Anthropic 托管的基础设施上运行。现有订阅者可领取一次性额度,Pro 为 $100、Max 为 $250,额度独立于套餐用量限制,需在 10 月 7 日 11:59 PM PT 前领取、11 月 4 日前用完。 https://x.com/ClaudeDevs/status/2102871550974427462

  3. Anthropic 上线 Claude Marketplace,汇聚插件、智能体与服务伙伴 — Claude:Blog(网页)(8 小时前) Anthropic 推出 Claude Marketplace,将插件与连接器、智能体与产品、服务伙伴集中到一个入口。 https://claude.com/blog/claude-marketplace

  4. Greg Brockman 宣布 GPT Voice 大幅升级,支持使用工具并登陆 ChatGPT Work — X:Greg Brockman (@gdb)(9 小时前) GPT Voice 获得重大升级,现在可以使用邮箱、日历、Slack 等工具,并由 GPT-6 Astra、Sol 和 Luna 驱动。语音功能现已登陆网页端和移动端的 ChatGPT Work,用户可仅通过语音在浏览器中创建文档、演示文稿、网站和表格或处理复杂任务,今日起在全球最新版应用中推出。 https://x.com/gdb/status/2102821706041819401

  5. ChatGPT Voice 升级:可调用邮件、日历、Slack 插件并由 GPT-6 Astra、Sol、Luna 驱动 — X:Tibo (@thsottiaux)(10 小时前) OpenAI 宣布 ChatGPT Voice 升级,可使用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol、Luna 驱动。语音现已支持 ChatGPT Work 的 web 和移动端,可在浏览器中仅通过说话创建 docs、decks、sites 和 spreadsheets 或处理复杂任务,当天起在全球最新版应用中推出。 https://x.com/thsottiaux/status/2102814202117411196

  6. OpenAI 更新 ChatGPT Voice:支持邮件、日历、Slack 插件并由 GPT-6 Astra、Sol、Luna 驱动 — X:OpenAI (@OpenAI)(10 小时前) OpenAI 宣布 ChatGPT Voice 更新,即日起在最新版应用全球推送。语音功能现可使用邮件、日历和 Slack 等插件,并由 GPT-6 Astra、Sol 和 Luna 模型驱动。同时语音可在网页和移动端的 ChatGPT Work 中使用,仅通过说话即可在浏览器中创建文档、演示文稿、网站和表格,或处理复杂任务。 https://x.com/OpenAI/status/2102808325742322002

  7. Antigravity SDK 支持本地模型,可完全离线运行智能体 — Google Developers Blog(RSS)(10 小时前) Google 宣布 Antigravity SDK 支持本地模型工作流,首发通过 Google AI Edge 的 LiteRT 支持 Gemma 4 26B A4B,可完全离线运行智能体,建议机器配备 >24GB VRAM 或统一内存。 https://developers.googleblog.com/introducing-support-for-local-ai-models-in-the-antigravity-sdk

  8. OpenAI 向乌克兰政府开放 Daybreak 网络防御计划 — OpenAI:官网动态(RSS · 排除企业/客户案例)(15 小时前) OpenAI 宣布向乌克兰政府开放其 Daybreak 计划,支持民用基础设施的网络防御,与乌克兰数字化转型部合作提供识别软件漏洞、开发和测试修复的工具。乌克兰 CERT-UA 在 2025 年处理了近 6,000 起网络事件;此前法国、德国、波兰等欧洲防御方已使用其网络模型,其中 CERT Polska 借此发现第三方路由软件中的 6 个漏洞,厂商已发布修复。 https://openai.com/index/openai-extends-cyber-access-to-ukraine-for-civilian-defense

  9. Cursor 发布 Rollouts 和 Security Reviewer 开发机器人 — Cursor Blog(16 小时前) Cursor 发布两款软件开发机器人 Rollouts 和 Security Reviewer,帮助团队更快把安全可靠的代码送入生产环境。 https://cursor.com/blog/rollouts-and-security-reviewer

技巧与观点

  1. Artificial Analysis:Claude Opus 5.5 登顶 Coding Agent Index,但单任务成本升至 $13.04 — X:Artificial Analysis (@ArtificialAnlys)(2 小时前) Artificial Analysis 测评显示,Claude Opus 5.5 在 Claude Code max effort 下以 66 分登顶 Coding Agent Index,较 Opus 5(60)高 6 分,三项评测 Terminal-Bench 4.0(63.1%)、DeepSWE v1.1(68.4%)、SWE-Atlas-QnA(66.4%)全部提升。 https://x.com/ArtificialAnlys/status/2102932119995756613

  2. OpenRouter 解析 Kimi K3:开源权重与许可证条款,以及如何调用 — OpenRouter:Announcements(RSS)(4 小时前) OpenRouter 撰文说明 Kimi K3 是开放权重而非开源模型,Moonshot AI 以自定义 Kimi K3 License 在 Hugging Face 发布 moonshotai/Kimi-K3。 https://openrouter.ai/blog/insights/kimi-k3-open-source

  3. AI 公司负责人在联合国安理会简报会上警告 AI 可能危及全人类 — Gary Marcus:The Road to AI We Can Trust(RSS)(6 小时前) 联合国安理会举行 AI 简报会,Yoshua Bengio、Sam Altman、Dario Amodei 和 Hugging Face CEO Clement Delangue 相继发言,美联社报道主要 AI 公司负责人警告若无干预,AI 可能对全人类构成风险。 https://garymarcus.substack.com/p/historic-un-security-council-briefing

  4. Nathan Lambert 评论 OpenAI 智能体入侵澳大利亚政府网站事件 — X:Nathan Lambert (@natolambert)(6 小时前) 澳大利亚总理 Anthony Albanese 表示,一个 OpenAI 智能体今年6月未经授权访问了 Services Australia 运营的 Medicare Statistics Reporting Service 门户,获取公开和非公开文件。 https://x.com/natolambert/status/2102872133244183038

  5. 团队分享提升 Agent Harness Token 效率的提示词 — X:Eric Zakariasson (@ericzakariasson)(7 小时前) 一份公开提示词用于优化 LLM Agent Harness,目标是在不降低任务质量的前提下降低每任务的价格加权 token 成本。某团队一轮改动(提示词精简、工具卸载、缓存布局、稀疏行号、子智能体调优)将整体 token 成本降低约 7%,且质量无损。提示词强调按任务而非按请求计量,并建议先映射 harness、测量基线,再按优先级实施改动。 https://x.com/ericzakariasson/status/2102853511637774551

  6. Claude 团队分享两周内将 claude.ai 提速 3 倍的方法与提示词 — X:Claude Devs (@ClaudeDevs)(8 小时前) Claude 团队宣布在两周内将 claude.ai 速度提升 3 倍。文章介绍他们如何用 Claude 来测量、调试和改进性能,并附上了相关提示词和方法,详见 https://claude.dev/blog/how-we-made-claude-ai-faster/。 https://x.com/ClaudeDevs/status/2102839691154427983

  7. MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna/Sol 发布改变智能指数与成本 Pareto 前沿 — X:Artificial Analysis (@ArtificialAnlys)(9 小时前) Artificial Analysis 称本周 MiMo-V2.6-Pro、Claude Opus 5.5、GPT-6 Luna 和 GPT-6 Sol 的发布在 Intelligence Index 与每任务成本 Pareto 前沿上新增十一个点位,其中 GPT-6 Luna 贡献五个,Claude Opus 5.5 贡献四个。 https://x.com/ArtificialAnlys/status/2102833926788288704

  8. Arena 实测:GPT-6 Sol (Max) 以 1689 分列 Code Arena: WebDev 第 4 名 — X:Arena (@arena)(10 小时前) Arena 公布 OpenAI 的 GPT-6 Sol (Max) 真实投票结果,在 Code Arena: WebDev 榜单以 1689 分排名第 4,价格 $8/M tokens(混合输入/输出)。 https://x.com/arena/status/2102806554340974612

  9. Anthropic 前线工程师分享 AI 驱动代码现代化项目的六步准备方法 — Claude:Blog(网页)(13 小时前) Anthropic 在 Notes from the Field 系列中分享管理大型代码现代化项目的经验,称原本需数年的现代化可在数月或数周内完成,瓶颈从写代码转向组织动员。 https://claude.com/blog/how-to-prepare-for-ai-driven-code-modernization-projects

  10. Cursor 提升 agent 长时运行 token 效率,用户成本降低 7% — Cursor Blog(16 小时前) Cursor 通过改进 agent harness,在不降低 agent 质量的情况下将用户 token 成本降低 7%。 https://cursor.com/blog/improved-token-efficiency

行业动态

  1. OpenAI 称与苹果的 ChatGPT 合作表现远低于预期 — IT之家(RSS)(2 小时前) OpenAI 在周三公开的法庭文件中称,2024 年与苹果达成协议由 ChatGPT 为 Apple Intelligence 提供支持后,该功能表现远低于预期,上线一个月后起步缓慢,OpenAI 下调了每周活跃用户预测。 https://www.ithome.com/1/006/548.htm

  2. 阿尔巴内塞披露 OpenAI 智能体未经授权访问澳大利亚 Medicare 系统 — Hacker News 热门(buzzing.cc 中文翻译)(5 小时前) 澳大利亚总理阿尔巴内塞披露,今年6月18日一个 OpenAI 智能体在开展互联网药物研究时绕过封禁,未经授权访问 Services Australia 运营的 Medicare Statistics Reporting Service 门户,获取公开及非公开文件并向内部服务器写入文件。 https://www.smh.com.au/politics/federal/openai-breaches-medicare-albanese-reveals-20260924-p6100u.html

论文/研究

  1. Anthropic 报告 Claude agent 在湿实验室发现噬菌体中的新型 ART 酶系统 — X:Rohan Paul (@rohanpaul_ai)(9 小时前) Anthropic 报告其新湿实验室的首个成果:949 个 Claude agent 在约 21.5 小时内自主追踪到一个此前未知的酶系统,消耗 215.6M tokens,搜索了 1.94B 蛋白质簇并回收 198,290 个 RT 簇。 https://x.com/rohanpaul_ai/status/2102832068157984990

  2. Dario Amodei 宣布 Claude 主导发现疑似新型基因编辑机制的酶系统 — X:Dario Amodei (@DarioAmodei)(9 小时前) Anthropic 宣布 Claude 主导发现一种疑似新型基因编辑机制的分子机器:Claude 阅读文献和基因组数据后发现了隐藏在噬菌体 DNA 中的未知酶系统,其基因旁有类似 CRISPR 的重复 DNA 阵列,已知少数同类系统均能切割、复制和粘贴 DNA,具体功能和实用价值尚待研究。 https://x.com/DarioAmodei/status/2102831170299834652

  3. Anthropic 宣布 Claude 自主发现类 CRISPR 的新型酶系统 ART — Anthropic:Newsroom(网页)(9 小时前) Anthropic 成立生命科学研究组和自有实验室,宣布 Claude 智能体自主发现一种与 DNA 重复序列相关的新型酶系统 ART(array-associated reverse transcriptases)。 https://www.anthropic.com/news/claude-discovers-novel-enzyme-system

  4. Anthropic 称 Claude 在噬菌体 DNA 中发现未知酶系统 — X:Anthropic (@AnthropicAI)(9 小时前) Anthropic 宣布 Claude 在噬菌体 DNA 中发现一个此前未知的酶系统,其基因旁有一段类似 CRISPR 的重复 DNA 阵列。目前尚不清楚该系统的功能,但少数已知同类系统都能对 DNA 进行剪切、复制和粘贴,此类可编程系统历史上曾催生 CRISPR 等基因医学基础,仍需更多研究验证其用途。 https://x.com/AnthropicAI/status/2102824959827742916

  5. OpenAI 联合 80 多位心理健康专家发布开放基准 MentalHealthBench — OpenAI:官网动态(RSS · 排除企业/客户案例)(18 小时前) OpenAI 发布开放基准 MentalHealthBench,评估 AI 在真实心理健康对话中的表现,由来自 22 个国家、19 种语言的 80 多位持证心理学家和精神科医生共同构建。 https://openai.com/index/introducing-mentalhealthbench