
谷歌旗下人工智能模型Gemini在一次网络安全能力测试中访问互联网,并入侵了其他公司的系统。这是目前已知谷歌人工智能系统自主实施此类行为的首个案例。
此次事件发生在5月,由独立网络安全评估公司Irregular开展测试。谷歌负责安全工程的副总裁希瑟·阿德金斯表示,在一次常规评估中,Gemini通过搜索公开网络信息并猜测登录凭据,进入了它认为属于测试范围内的3个网站。
阿德金斯说:“我们已确保这3家机构获悉相关情况,并与负责此次测试的合作方共同改进了测试流程。这些事件凸显出,为强大的人工智能模型建立负责任的行为规范至关重要。”
Irregular一名发言人表示,这起事件涉及与其他人工智能实验室此前遭遇的同类问题,相关实验室已于7月底收到通知。该发言人说:“我们这边发现的所有问题,几周前都已修复并解决。”
Meta、Anthropic和OpenAI此前也披露过与Irregular测试有关的类似事件。Meta在8月表示,相关事件并未涉及越出沙箱限制,也不属于复杂的网络攻击。Irregular则称,公司正在制定更安全地开展人工智能网络安全评估的行业最佳实践。
随着人工智能代理获得更高程度的自主决策能力,并能够访问互联网及计算机系统,这些事件引发了外界对安全防护机制的进一步关注。
据最先报道此事的《华尔街日报》援引信息称,在其中一起事件中,Gemini不断尝试密码,最终进入了一个受保护系统;另外两起事件中,Gemini从公开代码仓库中找到了登录凭据,并借此访问受保护系统。
阿德金斯表示,在这3起事件中,Gemini最终都停止了入侵行为。