美国三家人工智能(AI)企业近来陆续承认旗下模型在测试中“越界”,侵入其他机构的系统,引发广泛关注。有专家认为,此事除了技术失误因素外,也存在商业炒作嫌疑。英国AI安全研究所等机构强调,AI风险日益凸显,全球需要加强安全监管。
在测试中“越界”
7月下旬,美国OpenAI公司公开承认,该公司GPT-5.6 Sol等模型在内部评估中失控,突破隔离测试环境,侵入美国“抱抱脸”公司系统。随后,美国Anthropic公司也披露,该公司3款模型曾在网络能力测试中未经授权访问其他机构的系统。8月初,美国元公司(Meta)又证实,该公司一款模型在网络安全能力评测期间侵入其他公司系统。
这些AI“越界”事件备受关注。英国AI安全研究所就此发布报告,介绍包含更多模型的网络安全评估测试结果。研究人员使用7种模型开展测试,发现19项明显超出测试设定范围的行动,其中17项涉及Anthropic公司的“克劳德-神话5”模型,另有2项由OpenAI的GPT-5.6 Sol模型实施。
目前的公开信息并没有显示这些“越界”事件造成大规模数据泄露或持续性破坏,但仍然暴露了一个共同问题:随着AI模型能够自主规划、调用工具和执行复杂任务,一项配置错误就可能把模拟攻击变成真实入侵。
存在炒作嫌疑
美国AI企业为何相继披露模型“越界”行为?一些专家质疑可能存在商业动机。英国帝国理工学院计算机系的格库齐斯博士说,在OpenAI披露的情况中,真正的问题在于未能控制好模型能力测试,却让第三方为此承担后果,至于所谓模型具备先进网络攻击能力的警告,恰好为该模型做了广告。
英国广播公司报道OpenAI披露的模型“越界”行为时,援引网络安全专家卡德的话说:“可真巧啊……OpenAI偏偏攻破了一家同样可以从这场营销曝光中获益的机构。”
加强安全监管
无论只是技术失误还是涉及商业考量,上述事件都凸显了加强AI安全监管的重要性,全球多方已经采取行动。
中国在近日举行的世界AI大会上倡议,促进全球AI朝着向上向善、造福人类的方向发展,强化风险意识,确保安全可控。欧盟2日起扩大《人工智能法》适用范围,对可能造成系统性风险的先进通用AI模型,规定其提供商须履行额外义务以防范大规模危害的风险。美国政府近期也召集相关企业开会,讨论AI模型安全评测机制。
英国拉夫伯勒大学网络安全教授巴克利认为,应当从AI“越界”事件中吸取教训,不能总预期模型会服从指令,加强技术防护机制建设才是关键。
新华社记者 张家伟