AI HOT 过去24小时精选

抓取时间:2026-08-12 12:00:13(北京时间) · 条目数量:20 · 数据来源:aihot.virxact.com

技巧与观点

  1. 零基础用户半天上手AI的12步实操流程 — 公众号:数字生命卡兹克(3 小时前) 文章给出一套零基础用户半天上手AI的12步实操流程:准备内存不低于16G的电脑,订阅ChatGPT并安装Codex或使用WorkBuddy,用语音输入法以【背景、痛点、需求】框架向AI交代任务,经苏格拉底提问澄清需求后投喂文件让AI直接完成,最后沉淀为可复用Skill。文中建议Codex选GPT-5.6 Sol最高模型,WorkBuddy选Kimi K3。 https://mp.weixin.qq.com/s?__biz=MzIyMzA5NjEyMA%3D%3D&mid=2647685084&idx=1&sn=0899296dbc140eeb745f7a99f9d5ed9c

  2. 将 GitHub Copilot 置于中间人(MitM)代理之后后,我学到了什么 — Hacker News 热门(buzzing.cc 中文翻译)(9 小时前) 作者通过 mitmproxy 对 VS Code 中的 GitHub Copilot 进行中间人代理拦截,逆向分析其网络流量与内部架构。文章指出这些 AI 应用普遍基于 Electron 构建,共享相似的网络栈,因此探测结果可迁移至其他同类应用。作者借此揭示了 Copilot 的运行时行为,并分享了配置代理的具体步骤。 https://www.lighthousenewsletter.com/p/i-put-github-copilot-behind-a-mitm

  3. Ryan Greenblatt:人类级AI或于2032年前通过递归自我改进催生失控超级智能 — Dwarkesh Patel:Podcast & Blog(RSS)(11 小时前) Dwarkesh Patel与Redwood Research首席科学家Ryan Greenblatt探讨递归自我改进(RSI)的可能性:一旦AI达到人类顶级专家水平,可能在一年内实现相当于4-5年的AI进展,Ryan的中位预期是2031年自动化AI研发。双方还讨论了超级智能的对齐对象、奖励黑客行为是否会升级为AI联手接管世界等风险。 https://www.dwarkesh.com/p/ryan-greenblatt

  4. OpenAI 用 Astra 模型攻克 10 道数学难题,数学家既兴奋又担忧 — The Verge:AI(RSS)(17 小时前) OpenAI 宣布其未发布的 Astra 模型解决了 10 道长期悬而未决的数学难题,涵盖球体堆积、纠错码、非 sofic 群存在性等领域,并发布超 250 页论文及 Lean 验证结果。 https://www.theverge.com/ai-artificial-intelligence/977273/the-ai-takeover-of-mathematics-has-begun

  5. 用 ComfyUI API 实现 MiniMax-H3 多模态视频与音频生成流水线 — MarkTechPost(RSS)(22 小时前) 本教程演示如何以 ComfyUI 为无头推理后端,构建端到端的 MiniMax-H3 视频生成工作流。通过 Python 直接构建执行图,支持文生视频、首尾帧条件生成和参考图像条件生成,并自动根据 GPU 显存选择 quality、balanced、squeeze 三种权重配置。流水线涵盖模型自动下载、节点模式校验、音视频联合解码与进度监控,无需图形界面即可复现实验。 https://www.marktechpost.com/2026/08/10/implementing-a-minimax-h3-multimodal-video-and-audio-generation-pipeline-with-comfyui-apis

  6. 编写智能体时,哪种编程语言最合适? — Hacker News 热门(buzzing.cc 中文翻译)(23 小时前) 针对"动态语言比静态语言更省 LLM token"的流行说法,作者用 GPT-5.6 Sol 让智能体实现 zstd 解码器进行实测。结果显示,medium 努力度下动态语言表现更好,ultra 下静态语言反而更优,且此前评测存在测试路径错误等缺陷。作者认为,琐碎任务上的性能无法推广到更大问题。 http://danluu.com/pl-tokens

行业动态

  1. ChatGPT 与 Gemini 双双突破 10 亿用户 — The Verge:AI(RSS)(8 小时前) OpenAI 与 Google 的聊天机器人均跨过 10 亿用户门槛。OpenAI 在 8 月 6 日的博文中披露 ChatGPT 月活用户超 10 亿,Google CEO 皮查伊则宣布 Gemini 月活达 10 亿,成为其史上增长最快的产品。OpenAI 称 ChatGPT 在 7 月周活用户已达 10 亿,而 Gemini 在 2 月月活为 7.5 亿,增长势头更猛。 https://www.theverge.com/ai-artificial-intelligence/978113/chatgpt-gemini-1-billion-users

  2. 研究人员发现可读取ChatGPT等模型加密推理过程的API漏洞 — The Decoder:AI News(RSS)(10 小时前) Alexander Panfilov团队发现OpenAI、Anthropic、Google等主要AI提供商API存在漏洞,可读取推理模型的加密思考过程。扫描约7000条公开会话发现62个API密钥、33个邮箱和33个密码。通过越狱,Anthropic的Haiku 4.5可逐字转写Opus 4.8的原始推理;解码10000条推理轨迹的API成本约720美元。 https://the-decoder.com/but-marinade-and-leaked-passwords-are-what-researchers-found-in-chatgpts-hidden-reasoning

  3. Gemini月活破10亿,成谷歌增长最快产品 — X:Sundar Pichai (@sundarpichai)(10 小时前) 每月已有超过 10 亿人使用 @Geminiapp 激发新想法、完成工作。这是我们有史以来增长最快的产品,也是第 14 个达到 10 亿用户里程碑的产品。

感谢 @JoshWoodward 和整个 Gemini 团队,也感谢每一位与我们同行的伙伴--未来还有更多精彩! https://x.com/sundarpichai/status/2087222656819241292

  1. 消息称英伟达开发万亿参数开源 AI 模型 Nemotron 4,目标挑战全球顶级 — IT之家(RSS)(13 小时前) 英伟达正在研发新一代开源 AI 模型系列 Nemotron 4,规模最大的模型预计至少拥有 1 万亿个参数,旨在与全球最先进的开源模型竞争。英伟达尚未确定发布日期,最终训练也未完成,员工认为该模型最早可能在今年秋末准备就绪。此举意在通过开放模型生态扩大 AI 应用范围,并推动市场对其 GPU 算力的需求。 https://www.ithome.com/0/988/524.htm

产品发布/更新

  1. Runway Seedance 2.5 上线,支持50角色参考 — X:Runway (@runwayml)(9 小时前) 完整阵容,完整曲目,一次生成一个。

Seedance 2.5 已在 Runway 上线,支持 50 个独特角色参考,以及最长 30 秒、与音乐同步的片段。点击下方链接即可开始使用。 https://x.com/runwayml/status/2087251184658657346

  1. ChatGPT 桌面端支持导入其他智能体工作数据 — X:OpenAI Developers (@OpenAIDevs)(9 小时前) 你现在可以将其他智能体的工作内容与 ChatGPT Work 和 Codex 保持同步。

可导入项目、聊天记录、技能和插件,查看导入历史,并可在设置中选择开启自动更新。

现已在 ChatGPT 桌面应用中提供。 https://x.com/OpenAIDevs/status/2087242829076791392

  1. Gemini 助力 Database Migration Service 加速 PostgreSQL 迁移 — Google Cloud:Databases(RSS)(12 小时前) Google Cloud 在 Database Migration Service(DMS)中推出由 Gemini 驱动的 AI 辅助代码转换,可将 Oracle 或 SQL Server 的存储过程、触发器和自定义函数转换为 PostgreSQL PL/pgSQL 代码。 https://cloud.google.com/blog/products/databases/accelerate-postgresql-migrations-with-gemini-in-dms

  2. ZCode全面升级:Goal、Subagents、Remote Control与闲时任务四大功能上线 — 公众号:智谱(GLM)(22 小时前) ZCode针对GLM深度优化,今日上线Goal、Subagents、Remote Control与闲时任务四大功能。在Z.ai Code Bench测试中,GLM-5.2搭配ZCode较搭配Claude Code任务整体通过率高2.39%;ZCode缓存命中率超98%,叠加1.5倍限时额度加成后,GLM Coding Plan整体使用量接近常规额度的1.8倍。 https://mp.weixin.qq.com/s?__biz=MzkyMzI3NzQ0Mg%3D%3D&mid=2247494052&idx=1&sn=ee3ab3d0f4550e9120927c53a27522c9

论文/研究

  1. AMIE 研究医疗 AI 系统首次展示实时临床视频问诊能力 — Google Blog:AI(RSS)(11 小时前) Google Research 与 Google DeepMind 推进医疗 AI 系统 AMIE,实现实时临床视频问诊,首次在此场景展示专家级 AI 能力。该系统基于 Gemini 和 Project Astra 构建,可解读视觉与听觉线索、引导虚拟体格检查并实时诊断推理。随机研究中,临床评估者对 AMIE 的病史采集、诊断准确性等核心能力给予好评,患者演员也更偏好视频体验。 https://blog.google/innovation-and-ai/models-and-research/google-research/amie-video-consultations

  2. Apple Silicon 与 macOS 虚拟机:借助 Llama.cpp 实现 11-16 倍的 LLM 推理加速 — Hacker News 热门(buzzing.cc 中文翻译)(11 小时前) 研究团队为 macOS 虚拟机中的 Metal 能力查询构建进程级兼容层,使 llama.cpp 能选用更新的 Metal 内核。在 M1 Ultra 上,TinyLlama 1.1B 的提示处理速度提升 11.08 倍、token 生成提升 16.36 倍,接近裸机性能的 98%;Gemma 4 12B 的提示处理与生成速度分别提升 7.20 倍和 14.54 倍。 https://github.com/trycua/cua/blob/main/blog/gpu-passthrough-macos-vms.md

  3. 统一 Radix 缓存:为混合模型前缀缓存构建单一树结构 — LMSYS:Blog(Chatbot Arena 团队)(14 小时前) LMSYS 团队提出 Unified Radix Cache,用单一 token 键控 radix 拓扑统一管理混合模型的 FULL、SWA 和 MAMBA 组件缓存,各组件独立执行路径、滑动窗口和检查点复用语义。 https://www.lmsys.org/blog/2026-08-11-unified-radix-cache

模型发布/更新

  1. SGLang 宣布 Day-0 支持 NVIDIA Nemotron 3.5 Lightning — LMSYS:Blog(Chatbot Arena 团队)(14 小时前) SGLang 宣布对 NVIDIA Nemotron 3.5 Lightning 提供 Day-0 支持,该开源模型为 30B 总参数、3B 激活参数的混合专家架构,支持最长 1M token 上下文,可从 Hugging Face 下载 BF16 和 NVFP4 权重。模型支持 MTP、DFlash、DSpark 三种投机解码技术,并可通过 OpenAI 兼容 API 接入智能体工作流。 https://www.lmsys.org/blog/2026-08-11-nemotron-3-5-lightning

  2. NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务 — NVIDIA Blog(RSS)(14 小时前) NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。 https://blogs.nvidia.com/blog/local-ai-open-source-models-agents-nemotron

  3. Ling-3.0-tiny 正式开源:1.3B 激活参数如何进入真实任务 — 公众号:蚂蚁百灵(Ling)(18 小时前) 蚂蚁百灵开源 Ling-3.0-tiny,一款总参数 7.9B、推理时仅激活 1.3B 参数的原生混合推理模型,同步提供 BF16、FP8 和 INT4 三个版本。 https://mp.weixin.qq.com/s?__biz=MzkyODk2MDQwNw%3D%3D&mid=2247487491&idx=1&sn=fcb14aceb054f9a24e22525d3dae6fa0