这周 AI 圈有几件事值得细看。
OpenAI 本周发布了一个新模型:GPT-Red。这个模型的定位很特殊——不是给普通用户用的,而是专门用来"攻击其他 AI"的。
什么是红队测试?
红队测试是安全领域的概念:让一组人扮演"攻击者",尝试突破系统的防御,找出漏洞。在 AI 领域,红队测试就是让 AI 或人类尝试让模型输出有害内容、绕过安全限制、执行危险操作。
GPT-Red 能做什么?
OpenAI 称,GPT-Red 能攻破"几乎所有它测试过的模型"。OpenAI 已经用它找到了 GPT-5.6 Sol 中的漏洞,并据此做了加固——称 GPT-5.6 Sol 是"目前对抗提示注入攻击最健壮的模型"。
这意味着什么?
AI 安全领域正在进入一个新阶段:用 AI 来测试 AI。这种自动化红队测试可以更快地发现模型漏洞,但也带来一个问题——如果攻击者和防御者都用 AI,这场"猫鼠游戏"会不会升级得太快?
Mira Murati 是谁?OpenAI 前任 CTO,2023 年 Sam Altman 被罢免期间曾短暂担任 CEO。她在 2024 年离开 OpenAI,创办了 Thinking Machines Lab。
本周,Thinking Machines Lab 发布了首个模型:Inkling。
几个关键信息:
这种"压低预期"的沟通策略挺少见。大多数公司发布模型时会强调"最强""领先",Thinking Machines Lab 反其道而行——可能是在管理用户预期,也可能是因为他们真的把重心放在未来的模型上。
值得关注的是:Thinking Machines Lab 走的是开放权重路线,这和 OpenAI 的封闭路线形成对比。Mira Murati 的团队会不会成为"开源版 OpenAI"?目前还看不清,但 Inkling 是一个信号。
Apple Intelligence(苹果的 AI 服务)在中国市场的落地有了实质性进展。
关键信息:
这意味着什么?
苹果没有选择把自家的 AI 模型直接部署到中国,而是采用了"本地合规 + 本土合作"的模式。这和微软、Google 在中国的策略类似——技术上可行,但合规成本太高,不如和本土公司合作。
对用户来说,Apple Intelligence 在中国的体验会和海外版本有差异:底层模型不是苹果自家的,而是阿里和百度的。这种"阉割版"体验能不能被接受,要看苹果的本地化整合能力。
每天 3 条深度解读,看懂 AI 行业的真实变化。
评论区