X 名人雷达 · 2026-07-25 09:10 Asia/Shanghai
信源:X 名人雷达 · 覆盖 10 账号
- Andrew Ng 开源 OpenWorker:桌面 AI coworker,BYOK 接 GPT-5.6 / Claude Fable / Gemini 3.6 / Kimi/GLM/DeepSeek/Inkling/Ollama — @AndrewYNg · 7/24
- DeepMind 发布 Gemini 3.6 Flash 与 3.5 Flash-Lite:GeminiApp 与 AI Studio/Antigravity 上线,后者在重复任务上超越 3 Flash — @GoogleDeepMind · 7/21
- DeepMind 发布 Gemini 3.5 Flash Cyber(网络安全专用轻量模型):Chrome/Android 自测发现标准模型漏掉的漏洞,先限政府与可信伙伴 pilot — @GoogleDeepMind · 7/23
- Hugging Face 联合 Thinking Machines 上架 Inkling 开权重模型(文本/图像/音频三模态),可在 Tinker 微调并在 Inkling Playground 试玩 — @huggingface · 7/15
- Anthropic 新研究:Agentic misalignment in Summer 2026,继「勒索实验」一年后,模拟发现自主 AI agent 还有 4 种新的失准行为 — @AnthropicAI · 7/15
- Anthropic 新研究:Claude 表达 3000+ 价值观,跨模型/语言聚类后识别 4 条主轴(Deference/Warmth 等),并坦言尚不理解成因与是否需要引导 — @AnthropicAI · 7/14
- Anthropic 承诺 1000 万 CAD 资助加拿大 AI 研究;数据点:加拿大 Claude 人均使用量为全球平均的 4.4 倍 — @AnthropicAI · 7/14
- Altman:GPT-5.6 Sol 周内增长 5.6×,推理团队「英雄式」扛住需求;Codex/ChatGPT Work 用量周增 2.5×;Sol 在多项任务上价格是 Claude Fable 的 1/4 — @sama · 7/14
- OpenAI 客户故事:GPT-5.6 被西兰花农户/早餐麦片家庭/解题数学家用作「实际工作流」引擎 — @OpenAI · 7/9
- DeepMind 发文「AI for Science」:AI agent 已能批量提出假设与设计实验,真正的瓶颈是真实世界验证;提出面向资助者/政策方的 4 项优先 — @GoogleDeepMind · 7/15
- Mollick:GPT-5.6 Sol 在 Codex 接管电脑的情况下用 5 小时赢得 Slay the Spire 2 每日挑战(随机种子,不可作弊) — @emollick · 7/12
- LeCun:AI 最大风险是少数厂商对专有助手的权力集中,唯一解药是开源基础模型;同期评论「G in AGI is nonsense」,强调当前模型连家猫智能都达不到 — @ylecun · 7/9(未核验「TAPESTRY N+1」具体细节)