AI HOT 过去24小时精选

抓取时间:2026-08-05 12:03:08(北京时间) · 条目数量:29 · 数据来源:aihot.virxact.com

模型发布/更新

  1. Qwen-Image-3.0-Pro 上线 Qwen Cloud — X:通义千问 / Qwen (@Alibaba_Qwen)(1 小时前) 阿里通义千问发布 Qwen-Image-3.0-Pro 与 Standard,现已在 Qwen Cloud 上线。该模型在 Arena 文生图榜单中位列中国模型第一、主流模型第二,支持 4.5k-token 提示词、10px 级文字渲染及 12 种语言。Pro 版起价 $0.04/张,Standard 版起价 $0.03/张。 https://x.com/Alibaba_Qwen/status/2084831888729072121

  2. OpenRouter 上线 FLUX 3 Video 统一多模态模型 — X:OpenRouter (@OpenRouter)(10 小时前) @bfl_ai 的 FLUX 3 Video 现已在 OpenRouter 上向所有人开放。

一个统一的视频、音频、图像和动作预测多模态模型家族。严肃、有趣、创意、真实、电影感,随你所需。基于统一架构联合训练。 https://x.com/OpenRouter/status/2084699413898027064

  1. 商汤 SenseNova U1 开源:统一推理与图像生成 — X:商汤 SenseTime (@SenseTime_AI)(12 小时前) 商汤发布开源模型 SenseNova U1,可在统一流程中同时进行推理与图像生成。其信息图模式可将单条提示词转为结构化幻灯片,交错模式则逐步生成图文内容,如演示六步画龙教程。模型已上线 SenseNova Studio、HuggingFace 及 GitHub。 https://x.com/SenseTime_AI/status/2084667189479837741

  2. 蚂蚁百灵发布Ling-3.0-flash开源权重 — X:蚂蚁百灵 (@AntLingAGI)(12 小时前) 今天,我们发布了 Ling-3.0-flash 的开源权重。🎉

官方 BF16 和 FP8 量化版本现已可用,您可以根据自己的硬件、性能要求和部署需求选择最合适的版本。 https://x.com/AntLingAGI/status/2084656533489754475

  1. NVIDIA Alpamayo 2 Super 开放商用,面向 Robotaxi 与自动驾驶的前沿开源模型 — NVIDIA Blog(RSS)(13 小时前) NVIDIA Alpamayo 2 Super 现已开放商用,基于 Cosmos 3 Super Reasoner 构建,采用强化学习后训练,支持轨迹预测、因果链推理、元动作、自动标注及视觉问答等多任务输出。 https://blogs.nvidia.com/blog/alpamayo-2-super-open-model-now-available

  2. 腾讯混元发布 Hy ASR 3.0 preview:真正懂上下文的语音识别 — 公众号:腾讯混元(19 小时前) 腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,基于大语言模型 Hy3 与 MoE 架构,融合高精度识别与语义理解。其在开源评测集中中文普通话 WER 3.34%、英语 WER 2.62%、粤语 WER 3.12%,并支持上下文纠错、热词注入及高噪耳语等场景。该模型已上线腾讯云 API,元宝 App 首发并免费开放。 https://mp.weixin.qq.com/s?__biz=MzkwODU2OTQyNQ%3D%3D&mid=2247498223&idx=1&sn=ae271ec2c72723393d3e1d8074a33205

技巧与观点

  1. 开源「活人感写作.skill」:一个帮你写出没有AI味的文字的通用写作技能 — 公众号:数字生命卡兹克(2 小时前) 数字生命卡兹克开源「活人感写作.skill」(英文名 human Writing.skill),旨在去除AI味、帮用户写出有真实生活感的文字。该Skill鼓励用户提供真实案例与情感,并针对辞章端禁用AI常用口癖和黑话,同时适配Qwen 3.8 Max、DeepSeek V4 Pro、Kimi K3等模型,可直接用于WorkBuddy、千问办公等产品。 https://mp.weixin.qq.com/s?__biz=MzIyMzA5NjEyMA%3D%3D&mid=2647684946&idx=1&sn=ae7edcc572b998dc4e1ac3591977aa85

  2. MiniMax-H3 通过 MLX 移植可在 Apple Silicon 上运行 — Simon Willison 博客(8 小时前) MiniMax 发布 MiniMax-H3,一个可接受文本、图像、音频和视频并生成最长 15 秒带音频视频片段的通用全模态生成系统。Python 包 PipeNetwork/minimax-h3-mlx 将其移植到 MLX,支持 Apple Silicon 运行。作者在 M5 Max MacBook Pro 上实测,下载约 115 GB 模型文件,视频生成耗时不到 45 分钟。 https://simonwillison.net/2026/Aug/4/minimax-h3-mlx

  3. GitHub 如何用堆叠式 Pull Request 拆解 AI 生成的巨型代码 — GitHub Blog(11 小时前) GitHub 介绍用堆叠式 Pull Request(stacked PR)解决 AI 编码智能体生成巨型代码难以审查的问题。通过将 1,000+ 行的大 diff 按数据、API、接线、UI 拆成 L1-L4 四个独立分层,每层可分配不同审查者。 https://github.blog/engineering/turn-one-giant-ai-generated-pull-request-to-a-reviewable-stack

  4. Cloudflare 如何用软件工厂将 Astro 的 GitHub issue 数降至零 — Cloudflare Blog(15 小时前) Cloudflare 在 Astro 仓库上运行自动化 triage 流水线,通过隔离的 AI 子代理复现、诊断并修复 bug,将开放 issue 从 200 多个降至约 30 个,预计下月归零。该流水线由 issue 标签驱动,修复后自动发布预览版本供用户验证。其底层引擎已发展为 Flue,一个开源的平台无关框架,用于构建持久化智能体与工作流。 https://blog.cloudflare.com/astro-issue-triage

  5. 在单颗 AMD MI300X 上运行 DeepSeek V4 Flash — Hacker News 热门(buzzing.cc 中文翻译)(15 小时前) 一个开源仓库提供了在单颗 AMD MI300X 上生产运行 DeepSeek-V4-Flash-0731 的完整配置与补丁,无需额外量化或权重卸载。该 304B 参数模型在 192 GB HBM 上实现单流 168.6 tok/s 解码、8 并发流 542 tok/s 聚合吞吐,并验证了 256K 上下文。 https://github.com/ryanzhou/deepseek-v4-flash-mi300x

  6. 用 NVIDIA SkillSpector、LangGraph、YARA 规则、SARIF 与 CI 策略门构建高级 AI 技能安全审计流水线 — MarkTechPost(RSS)(19 小时前) 本教程演示如何用 NVIDIA SkillSpector 评估 AI 技能的安全态势,构建包含干净、风险、恶意及 MCP 示例的合成技能市场,并通过 LangGraph 检查流水线扫描每个技能。 https://www.marktechpost.com/2026/08/04/building-an-advanced-ai-skill-security-auditing-pipeline-with-nvidia-skillspector-langgraph-yara-rules-sarif-and-ci-policy-gates

产品发布/更新

  1. LLM 0.32 发布:新增推理轨迹、OpenAI Responses、服务端工具与更智能的日志 — Simon Willison 博客(4 小时前) Simon Willison 发布 LLM 0.32,这是该项目自启动以来最重要的新版本。新版本支持显示推理轨迹、服务端工具、OpenAI Responses API,并默认使用 GPT-5.6 Luna 模型。 https://simonwillison.net/2026/Aug/4/new-release-of-llm

  2. Replit 环境智能:免提示词自动生成设计 — X:Replit (@Replit)(6 小时前) 你无需提示词,也无需设计语言。

环境智能(Ambient Intelligence)会在每个画面旁显示建议卡片,每张卡片都指向你的设计的一个不同方向。点击你喜欢的那张,即可看到它生成一个新的画面。

你再也不必纠结下一步该做什么。

立即在 http://replit.com/design 体验。 https://x.com/Replit/status/2084761337570144424

  1. Soup v0.72.4:在4 GB显存笔记本GPU上微调8B模型 — Hacker News 热门(buzzing.cc 中文翻译)(9 小时前) Soup 推出 v0.72.4,支持在配备 4 GB 显存的笔记本 GPU 上通过 QLoRA 微调 8B 模型,无需 SSH 或云服务。 https://github.com/MakazhanAlpamys/Soup

  2. SpecForge v0.3.0 发布:统一解耦与共置投机解码栈,新增开放 SpecBundle 草稿模型 — LMSYS:Blog(Chatbot Arena 团队)(10 小时前) SpecForge v0.3.0 将目标模型推理与草稿模型训练分离,支持 EAGLE3、EAGLE3.1、P-EAGLE、DFlash、Domino、DSpark 等多种投机解码算法,并统一在线、离线与解耦工作流。 https://www.lmsys.org/blog/2026-08-04-specforge-v0-3

  3. Google Cloud API Gateway 推出统一模型路由功能,支持 Gemini、Claude 与 OpenAI OSS-GPT — Google Developers Blog(RSS)(11 小时前) Google Cloud API Gateway 新增模型路由功能(Public Preview),开发者可在 OpenAPI 3.x 规范中配置虚拟模型名到后端目标的映射,无需硬编码端点或管理开源代理。网关作为无服务器入口层,接受标准 OpenAI 兼容请求,自动将负载转码为目标模型的原生格式并动态路由流量。 https://developers.googleblog.com/a-unified-api-for-ai-model-routing

  4. Google Cloud 推出 Database Operations Agents,实现自主数据库管理 — Google Cloud:Databases(RSS)(12 小时前) Google Cloud 在 Agentic Data Cloud 发布中推出两款 AI 数据库智能体:Database Onboarding Agent 负责 Day 0 的配置与部署,Database Observability Agent 负责 Day 1/2 的监控、故障排查与维护。 https://cloud.google.com/blog/products/databases/deep-dive-on-new-ai-powered-database-agents

  5. NVIDIA 开源 cuFile API,推动 GPU 直连存储 — NVIDIA Blog(RSS)(13 小时前) NVIDIA 在 FMS 大会上宣布开源 cuFile API 及底层存储软件栈,让 GPU 可直接读写存储,访问延迟降至微秒级。其 Vera CPU 在两级压缩与加密流水线中吞吐量比 x86 CPU 最高提升 3.21 倍,并联合 40 多家厂商推出 Storage-Next 计划。 https://blogs.nvidia.com/blog/ai-storage-fms

  6. Cloudflare 让智能体通过本地追踪调试 Workers — Cloudflare Blog(15 小时前) Cloudflare 即日起在 wrangler dev 和 vite dev 中自动为本地 Worker 调用捕获 OpenTelemetry 追踪,无需安装 SDK 或配置智能体。智能体可通过 Local Explorer API 查询追踪数据,定位失败操作、修复本地环境并验证结果。开发者也可在浏览器界面 Local Explorer 中可视化查看 spans、时序、错误及关联控制台日志。 https://blog.cloudflare.com/local-tracing

  7. Cloudflare 推出 Agents 平台,率先上线智能体追踪功能 — Cloudflare Blog(15 小时前) Cloudflare 推出 Cloudflare Agents,将部署在平台上的智能体会话统一到一个视图中,并率先上线 agent tracing 功能。该功能支持 OpenTelemetry 兼容的 Think、Flue 和 AI SDK 等智能体框架,可测量每次模型调用、工具执行和 token 消耗。 https://blog.cloudflare.com/agents-on-cloudflare

  8. Cloudflare 推出 CI SDK:在 Cloudflare 上为百万级仓库运行 CI/CD 流水线 — Cloudflare Blog(15 小时前) Cloudflare 推出基于 Workflows 和 Sandbox SDK 的 CI SDK,让平台方直接在 Cloudflare 上运行 CI/CD 流水线,支持构建、lint、类型检查、单元测试、依赖缓存及条件部署。 https://blog.cloudflare.com/ci-workflows

  9. Cloudflare 推出 Agent Development Lifecycle,让智能体接管更多软件开发生命周期 — Cloudflare Blog(15 小时前) Cloudflare 宣布推出 Agent Development Lifecycle(ADLC),以取代传统 SDLC,让 AI 智能体从仅生成代码扩展到承担更多开发流程。 https://blog.cloudflare.com/agent-development-lifecycle

  10. Reflex 开源 XY:基于 Rust 的超快 Python 绘图库,可保持 1 亿点图表交互流畅 — MarkTechPost(RSS)(19 小时前) Reflex AI 发布 Apache-2.0 许可的 Python 交互式 2D 绘图库 XY,通过 Rust 原生核心、二进制缓冲传输和 WebGL2 渲染,在 1 万至 1 亿点范围内保持约 0.08 秒的渲染时间。 https://www.marktechpost.com/2026/08/04/reflex-open-sources-xy-a-rust-backed-super-fast-python-charting-library-that-keeps-100-million-point-charts-interactive

  11. Swiftlet:在 Mac 上运行 80B 版 Qwen(内存 4.3 GB),在 iPhone 上运行 35B 版 — Hacker News 热门(buzzing.cc 中文翻译)(21 小时前) Swiftlet 是一个 Swift + Metal 运行时,可在普通 Apple 设备上运行 Qwen3-Next 和 Qwen3.5/3.6 MoE 混合模型,仅将小型稠密核心驻留内存,按需从存储流式加载路由专家权重。 https://github.com/leonickson1/Swiftlet

  12. 面壁智能开源 ForgeStencil:一周自动优化 100+ 工业与科学软件,全程零人工介入 — 公众号:面壁智能(MiniCPM)(23 小时前) 面壁智能联合 OpenBMB 开源全球首个支持 Stencil 自动研究、自动部署的 AI 优化系统 ForgeStencil,由 Kernel Agent 与 App Agent 闭环协作,实现从算子优化到应用集成的全自动流程。 https://mp.weixin.qq.com/s?__biz=Mzg3Mzg2MTg2NQ%3D%3D&mid=2247498861&idx=1&sn=d2d16692dd7eb27f9d466803f25c2b78

行业动态

  1. Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议 — X:Rohan Paul (@rohanpaul_ai)(13 小时前) Anthropic 与成立仅数月的云初创公司 Volta 签署 100 亿美元算力协议,约合每年 17 亿美元。Volta 估值 24 亿美元,硬件几乎全为租用:算力来自比特币矿商 Bitdeer 挪威 121MW 站点,芯片由 Nvidia 供应、Dell 组装。Anthropic 买的是交付速度,代价是承担超大规模云厂商合同从未有过的交易对手风险。 https://x.com/rohanpaul_ai/status/2084655258102546579

  2. 工信部发布首部L3/L4自动驾驶系统安全要求强制性国标,2027年7月实施 — IT之家(RSS)(16 小时前) 工信部组织制定的《智能网联汽车 自动驾驶系统安全要求》(GB 44721-2026)强制性国家标准获批发布,拟于2027年7月1日起实施。这是我国首部针对L3级有条件自动驾驶和L4级高度自动驾驶系统的强制性国标,由2024年推荐性国标GB/T 44721-2024升级而来,为自动驾驶产品明确了统一的安全准入基线。 https://www.ithome.com/0/985/665.htm

  3. GPT-5.6 Luna降价80%永久生效 — X:Tibo (@thsottiaux)(22 小时前) 有些人显然误解了,但 GPT-5.6 Luna 降价 80% 不是临时噱头,而是永久的。效率提升不会消失。幸运的是。 https://x.com/thsottiaux/status/2084506501834829833