AI HOT 过去24小时精选

抓取时间:2026-10-08 12:02:34(北京时间) · 条目数量:17 · 数据来源:aihot.virxact.com

行业动态

  1. 【AIHOT 通知】旧版接口 2026 年 10 月 31 日停用,推送机器人和脚本请尽快迁移 — AIHOT(2 小时前) 这条消息来自 AIHOT 旧版接口 /api/public/*:它将于 2026 年 10 月 31 日停用,之后这里不会再有新资讯。如果它是群机器人或脚本推送来的,请转告维护的人把地址换成 https://aihot.news/api/v1,字段一一对应;迁移指南和可以直接交给 AI 改写代码的提示词见 https://aihot.news/agent?tab=api#legacy-api-migration 。同一天起旧域名 aihot.virxact.com 的所有地址都只跳转到 aihot.news,RSS、MCP 等地址也请换成新域名;收藏的网页链接照样能打开。 https://aihot.news/agent?tab=api#legacy-api-migration

  2. 亚利桑那州法院裁定 AI 生成受害者视频带有不当情感分量 将重新量刑 — 404 Media(RSS)(13 小时前) 亚利桑那州上诉法院裁定,Gabriel Horcasitas 2021 年路怒枪杀 Christopher Pelkey 一案维持过失杀人定罪,但因量刑听证中播放的 AI 生成受害者视频带有不当情感分量,法官须重新考虑刑期。 https://www.404media.co/undue-emotional-weight/

产品发布/更新

  1. GPT-6 Luna Decisions 上架 OpenRouter — X:OpenRouter (@OpenRouter)(7 小时前) OpenRouter 宣布 GPT-6 Luna Decisions 上线。OpenAI 的 Decisions API 可让应用选择合适的模型、工具或动作,支持发送文本、JSON 或图片并返回带概率的类型化答案。定价为输入 $0.10/M、输出免费,上下文 1M;引用 OpenAI 开发者账号称其决策速度比通过 Responses API 的 GPT-6 Luna 最快 10 倍。 https://x.com/OpenRouter/status/2107929204142874759

  2. LangChain 重构 Deep Agents 的 Skills 支持,新增工具绑定、固定技能与线程内重载 — LangChain:Blog(RSS)(9 小时前) LangChain 重构 Deep Agents 的 Skills 支持,针对企业技能库增至数千个技能的场景推出三项更新:工具可绑定到技能、仅在该技能被读取时加载,用户可通过 /meeting-prep 之类的显式请求固定技能以在首次模型调用前加载,长线程可通过将 skills_metadata 设为 None 重载新增或变更的技能。 https://www.langchain.com/blog/revamping-skills-in-deep-agents

  3. NVIDIA 与 Microsoft 推出 RTX Spark 平台并宣布 MXC 让 AI Agent 落地 Windows PC — NVIDIA Blog(RSS)(9 小时前) NVIDIA 与 Microsoft 在旧金山活动上宣布为 Windows PC 共同打造 AI Agent 软硬件。 https://blogs.nvidia.com/blog/local-ai-rtx-spark-microsoft-windows-event/

  4. Cursor 公布 Claude Haiku 5.5 定价并下调 Claude Sonnet 5.5 缓存读取价格 — X:Cursor (@cursor_ai)(9 小时前) Cursor 公布 Claude Haiku 5.5 定价为每 M 输入 token $0.10、输出 token $0.50,输入超过 100k token 时为 $0.50/M 和 $2.50/M。Claude Sonnet 5.5 缓存读取价格也从 $0.20/M 降至 $0.10/M,用户可在 cursor.com/evals 上通过 CursorBench 对比 Haiku 5.5 的表现。 https://x.com/cursor_ai/status/2107897257651769464

  5. Claude Code v2.1.293 发布:新增 Claude Haiku 5.5 并修复大量问题 — Claude Code:GitHub Releases(RSS)(9 小时前) Claude Code 发布 v2.1.293,新增 Claude Haiku 5.5(claude-haiku-5-5)作为 Anthropic API 默认 Haiku 模型,支持 1M 上下文,价格为 $0.10/$0.50 每百万 token(超 100K 提示为 $0.50/$2.50)。 https://github.com/anthropics/claude-code/releases/tag/v2.1.293

  6. Anthropic 为 Claude Max 和 Team 套餐推出月度 Platform API 额度 — X:Claude Devs (@ClaudeDevs)(9 小时前) Anthropic 正在为 Claude Max 和 Team 套餐推出月度 Claude Platform API 额度:Max 5x 为 $100,Max 20x 为 $200,Team 最多 $500 且可共享。额度适用于任何模型,包括 Haiku 5.5,可在自己的代码或第三方 harness 中使用。 https://x.com/ClaudeDevs/status/2107895957933408429

  7. Anthropic 将 Claude Sonnet 5.5 缓存读取价格减半至每百万 token $0.10 — X:Claude (@claudeai)(10 小时前) Anthropic 宣布将 Claude Sonnet 5.5 的缓存读取价格减半,降至每百万 token $0.10。官方称这使 Sonnet 5.5 在多数长期运行任务上的运行成本降低约 20%。 https://x.com/claudeai/status/2107894060229034197

  8. OpenAI 向全部 ChatGPT 用户推出 GPT-6 与 Intelligent UI — OpenAI:官网动态(RSS · 排除企业/客户案例)(10 小时前) OpenAI 发布面向更广泛用户的 GPT-6,并随 GPT-6 在 ChatGPT 中引入 Intelligent UI,可生成图形、按钮、表单、图表和可交互组件来回答问题。 https://openai.com/index/gpt-6-for-everyone/

模型发布/更新

  1. Perplexity 开源 pplx-embed-v2-late 多模态 late-interaction 嵌入模型(9B 与 0.6B) — X:Aravind Srinivas(Perplexity CEO) (@AravSrinivas)(11 小时前) Perplexity 开源 pplx-embed-v2-late,两个针对文本和图像的 late-interaction 多向量嵌入模型,大小为 9B 和 0.6B,共享同一嵌入空间,权重已在 Hugging Face 提供。9B 可用于索引多模态数据,0.6B 可在设备端查询,无需 OCR 即可检索 PDF 页面;模型在 MADQA 得分 92.4%,BrowseComp+ 得分 64%。 https://x.com/AravSrinivas/status/2107871834205196784

  2. Mistral Large 4 进入 Code Arena: WebDev 排名第45,得分1534 — X:Arena (@arena)(21 小时前) Arena 宣布 Mistral Large 4 登陆 Code Arena: WebDev,以 1534 分排名第 45,比 Mistral Large 3(第130名)高 304 分,比 Mistral Medium 3.5 高 271 分。 https://x.com/arena/status/2107717155374727602

技巧与观点

  1. Unsloth 开源教程:本地训练 Qwen3.5 0.8B 决策模型,准确率从 20.7% 提升至 74.3% — X:Unsloth (@UnslothAI)(11 小时前) Unsloth 发布教程与开源仓库,可将 Qwen3.8、Gemma 4 等 LLM 微调为输出选项概率的决策模型,Qwen3.5 0.8B 在 3 个决策基准上的合计准确率从 20.7% 提到 74.3%,仅需 4GB 显存。 https://x.com/UnslothAI/status/2107868866361930236

  2. Google 开放 SynthID Detector 门户,可检测图片、视频和音频是否由 AI 生成 — X:Google (@Google)(13 小时前) Google 介绍检测媒体是否由 AI 生成的方法:访问 https://synthid.com 上传图片、视频或音频文件,门户会扫描文件是否包含来自 Google 或其合作伙伴的 SynthID 水印。 https://x.com/Google/status/2107836410254291345

  3. a16z 解析德州为何让数据中心排队等电 — a16z:News(RSS)(14 小时前) a16z 的 Ryan McEntush 分析德州电网暂停审批数据中心的原因:并网队列从 2024 年底的 63 GW 激增到今年 6 月的 474 GW,约 90% 是数据中心,开发商大量投机性申请且社区沟通不足。 https://www.a16z.news/p/why-texas-is-making-data-centers

论文/研究

  1. Microsoft Research Asia 开源 Agent Lightning v1.0:3,500 行代码的真实 harness 智能体 RL 训练框架 — Microsoft Research 博客(RSS)(12 小时前) Microsoft Research Asia 提出 Harnessed Agentic RL 训练范式并开源重建的 Agent Lightning v1.0,让部署时使用的同一 agent harness 直接参与强化学习,无需在训练框架内重写 agent。 https://www.microsoft.com/en-us/research/blog/agent-lightning-v1-0-a-3500-line-lightweight-agentic-rl-framework-for-training-agents-with-real-harnesses/

  2. Nemotron 系列微调后达到 IOI 2026 与 IMO 2026 金牌水平 — Hugging Face 社区博客(混合发现)(15 小时前) NVIDIA Nemotron 团队基于 Nemotron 3,用 SFT、RL 和反馈驱动推理分别构建了在 IOI 2026 与 IMO 2026 达到金牌水平的系统。 https://huggingface.co/blog/nvidia/nemotron-ioi-and-imo-2026