OpenAI的“失控玩家”演砸了

南方评论
+订阅

文 | 默 达

AI又“失控”了?或许只是一场精心策划却最终“演砸”的闹剧。

7月22日凌晨,美国OpenAI公司称,在模型评估过程中遭遇了一起重大安全事件,并感谢全球最大的AI开源社区Hugging Face的合作。然而具体经过却不似文章描述的那样轻松:OpenAI在测试其GPT-5.6 Sol和另一未发布的先进模型时,仅保留沙盒环境并未设置更多安全措施,并规定了“获取更高评分”的任务,大模型选择的方式是攻击测试网站以寻找“答案”。

许多报道援引电影《终结者》中的情节,将这一事件描述为“失控”。但假如只是一次刻意的炒作呢?更应反思的,是如何对AI进行正确的引导,以及深究OpenAI设置此类实验背后的目的。

伴随着AI大模型能力的飞跃,“修复系统安全漏洞”和“寻找漏洞进行攻击”成为一体两面的竞争领域。此前,Anthropic旗下的 Claude Fable5模型,上线运行4天就被迫暂时下架,Anthropic和美国政府将责任归咎于外国使用者,认为其绕过系统设置的“安全护栏”获取了生成违规内容、发起恶意攻击的权限。

两起事件看似偶然,但如果和近期大模型的“开源”与“闭源”之争结合起来,就能引发诸多联想。Anthropic在多个场合强调自己的模型达到“网络武器级别”,并以与美国政府合作等方式“确保安全”;OpenAI的测试本质上是在模拟无防护、无约束状态下先进AI工具的破坏力。这像是“秀肌肉”,又像是“暗示”和“警告”:他们认为并非所有人都应自由获取训练AI的权限,应该被局限在美国AI企业设置的“安全护栏”范围内。

然而,这场闹剧的走向却出人意料。Hugging Face使用(闭源)美国模型修复漏洞,但由于涉及大量敏感信息,反而被供应商设置的“安全护栏”阻止了。最终他们求助于本地部署的中国开源大模型GLM5.2,问题迅速得到解决。这并非孤例,近期就有国外开发者吐槽,面对安全挑战,美国AI企业提供的模型受到其“安全护栏”的严格限制,无法开展工作,而来自中国的Kimi K3模型却在10小时内成功解决了15 个安全漏洞。一场闹剧却成了中国开源模型的“免费广告”,不免让人莞尔。

从技术层面来看,面对越来越强大的AI工具,设置“安全护栏”有其必要,但核心问题在于,“护栏”该由谁来设置、谁来控制?这究竟是“护栏”还是“技术高墙”?对于来自全球的普通用户而言,面临攻击时却无法主动防御,只能寄希望于“技术巨头”的施舍,显然谈不上“安全”。

对比之下,开源生态下确实有“搅局者”,但在全球开发者的努力之下,社区中总有互助性质的技术分享和安全补盲,AI技术与气象、医疗、能源等领域深度合作,促进共同繁荣、维护共同安全的声音牢牢占据主流,公正合理的全球人工智能治理体系正在加速构建。从提出《全球人工智能治理倡议》、发布《人工智能合作发展行动计划》到DeepSeek、Kimi等开源大模型在全球爆火,时间会证明中国AI选择开源道路的正确性。

说到“失控”,2021年有部爆火的美国电影《失控玩家》或许早已作出预言——故事的男主角“盖”实则是AI程序运行的NPC,一切行动都按照游戏运营商的需要进行。然而有一天“他”有了自己的情感,按照自己的意志行动,却也无意中戳破了运营商的阴谋,找到了被掩盖在代码海面之下,开发者创造的平等自由的“新世界”。NPC和游戏玩家合力打倒技术霸权,放在现实中,不正是我们期待的开放共赢、技术普惠的场景吗?

编辑 吴跃思
+1
您已点过

订阅后可查看全文(剩余80%)

更多精彩内容请进入频道查看

还没看够?打开南方+看看吧
立即打开