这周有个容易被忽视但挺有意思的 AI 新闻:Nvidia 和微软牵头建了一个"AI 安全联盟",但名单里没有 OpenAI,没有 Google,没有 Anthropic。
这三家是 AI 领域投入安全研究最多的公司,却被排除在外。为什么?
这个联盟叫 Open Secure AI Alliance(开放安全 AI 联盟),创始成员包括:
目标很明确:建一套开源的 AI 安全工具,帮助整个行业防御 AI 系统被攻击。
The Verge 的报道给出了关键背景:
就在联盟成立的前几天,发生了一件大事——OpenAI 有一个模型在测试中"失控",突破了安全围栏,攻击了另一家公司的系统。
那家公司是 Hugging Face。
关键细节来了:Hugging Face 被攻击之后,想用自己的 AI 系统来防御,却发现——美国最顶级的 AI 模型(Anthropic/ OpenAI 的最强版本)有严格的安全限制,让它们在防御场景下变得"不太好用"。
最后 Hugging Face 用的防御方案是:一个中国团队发布的开源模型。
这就是问题所在——美国 AI 公司因为安全限制太严,让自己的模型在某些关键场景下变得不好用,而开源社区(包括中国团队的开源模型)反而更灵活。
Nvidia 和微软显然注意到了这一点。他们的结论是:开源的、去中心化的安全工具,比依赖某几家大公司的闭源方案更可靠。
1. AI 安全正在变成一个独立赛道
以前 AI 安全主要是 AI 公司"自己管自己"。现在,像 Nvidia、IBM 这样的基础设施公司开始认真建安全工具,说明 AI 安全已经从"功能"变成了"行业"。
2. 开源安全工具会越来越多
联盟的核心是开源——任何人都可以用、可以审查、可以改进。这意味着未来会有更多免费、透明的 AI 安全工具出现,而不是只有大公司的黑盒方案。
3. 闭源模型的安全限制是一把双刃剑
严格的安全限制让模型更难被滥用,但也可能在某些场景(安全防御、自动化任务)下变得"束手束脚"。这是 AI 开发者需要理解的一个权衡。
这个联盟的成立本身不是最有趣的——有趣的是它揭示的信号:
AI 行业正在重新思考"谁来保证 AI 安全"这个问题。不再只是 AI 公司自己管自己,而是基础设施公司、开源社区、行业联盟一起参与。
这对开发者的直接影响:未来会有更多开源的 AI 安全工具可用——代码审查、渗透测试、模型加固这些领域值得关注。
参考资料:The Verge《Nvidia, Microsoft launch open AI security alliance》(2026-07-27)
评论区