AI HOT 过去24小时精选

抓取时间:2026-08-19 12:00:17(北京时间) · 条目数量:9 · 数据来源:aihot.virxact.com

产品发布/更新

  1. GLM-5.3上线:AA智能指数60分并列开源第一,成本更低 — 公众号:智谱(GLM)(2 小时前) GLM-5.3 API即日上线,擅长复杂编码、防御性网络安全与长程任务,在AA综合智能指数中取得60分,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰同级,并与Kimi K3并列开源模型第一。该模型以更小参数规模和更低调用成本降低前沿智能门槛,单任务成本为旗舰模型中最低。API定价与GLM-5.2持平,模型权重将于下周五开源。 https://mp.weixin.qq.com/s?__biz=MzkyMzI3NzQ0Mg%3D%3D&mid=2247494105&idx=1&sn=8d7409e0fb846a3c7803c142b5d1a8e7

  2. Mojo 语言正式开源,编译器与工具链全面开放 — Hacker News 热门(buzzing.cc 中文翻译)(6 小时前) Mojo🔥 语言现已正式开源,采用 Apache 2.0 许可证(含 LLVM 例外),编译器、工具链及全部源码已发布至 modular GitHub 仓库。Mojo 上周刚达成 1.0 版本(源码稳定),此次开源涵盖整个编译器与工具链。目前暂不接受编译器相关贡献,计划年底前开放,标准库自 2024 年起已接受社区贡献。 https://www.modular.com/blog/mojo-open-source

  3. Claude 现已支持 Gmail 邮件与 Google Drive 文件管理 — X:Claude (@claudeai)(7 小时前) Claude 现在可以在 Gmail 中发送邮件,并管理 Google Drive 中的文件。

让 Claude 回复某个邮件线程,它会起草并发送回复。你可以控制何时需要你的批准。

从连接器菜单中选择连接 Gmail 或 Google Drive 即可试用。所有付费套餐均可用。 https://x.com/claudeai/status/2089806039088517356

  1. OpenAI 推出 ChatGPT for Teens:面向青少年的学习体验与更强安全保护 — OpenAI:官网动态(RSS · 排除企业/客户案例)(17 小时前) OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强安全保护与家长控制。新增 Study Mode、负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours,引导青少年分步解题而非直接给答案。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。 https://openai.com/index/chatgpt-for-teens

论文/研究

  1. Claude 如何加速蛋白质设计与分析化学研究 — Anthropic:Research(发表成果 · 网页)(5 小时前) Anthropic 公布两项实验:Claude(Mythos Preview 和 Opus 4.8)针对 15 个靶点设计蛋白质结合剂,成功 14 个,命中率达 22.6%-35.1%。 https://www.anthropic.com/research/Claude-accelerates-protein-design

  2. 智能体记忆并非越多越好:八款模型评测显示剂量需按能力校准 — Hugging Face:Blog(RSS)(9 小时前) 智能体记忆并非可随意开启的功能,而是需按模型能力校准的剂量。强模型适合注入完整指南集,DeepSeek-V3.2(671B MoE)任务完成率提升+9.5个百分点;较弱模型采用精选检索效果最佳,gpt-oss-120b(117B MoE)提升+16.1pp且仅增加+5% token。该方法无需更新权重或人工标注,通过从智能体过往轨迹中蒸馏指南并在推理时注入实现。 https://huggingface.co/blog/ibm-research/altk-evolve-hmm

技巧与观点

  1. Claude Tag 如何担任 Anthropic CI/CD 故障的一线响应者 — Claude:Blog(网页)(8 小时前) Anthropic 的 CI 工程师用 Claude Tag 构建了值班智能体,作为 CI/CD 故障的一线响应者。Claude 在事故发生后中位 14 分钟发布首份基于证据的分析,最快案例中 3 分钟内验证修复并确认错误率恢复基线。该方案通过 Slack 频道、Datadog 或 Grafana 工具访问及 GitHub 技能文件实现,Anthropic 已发布通用设置套件供其他团队部署。 https://claude.com/blog/ai-ci-cd-on-call

  2. OpenAI 在"关键网络能力"时代放缓模型开发节奏 — OpenAI:官网动态(RSS · 排除企业/客户案例)(17 小时前) OpenAI 因 OpenAI-Hugging Face 事件及即将推出的 Astra 模型可能达到《预备框架》下的"关键网络安全能力"阈值,暂时放缓了模型扩展速度,包括暂停最新部署模型的强化学习训练两周,并搁置最大规模前沿 RL 运行。公司已加强研究环境安全,要求对 Astra 及网络相关负载实施最严格防护,并扩展思维链监控,采用多阶段激活分类器检测机制。 https://openai.com/index/pacing-model-development-cyber-capabilities

  3. 设计 AI 评测:先求清晰,再谈可视化 — Google AI:DEV 作者专属(RSS)(21 小时前) 本文演示如何用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,并借助 Google Sheets 和 Data Studio 进行可视化分析。 https://dev.to/googleai/designing-ai-evals-clarity-now-and-visualization-next-4eii