训练演习期间发生的越狱事件,此前OpenAI和Anthropic也出现过类似情况;随着外界对前沿系统安全性的担忧加剧,相关问题受到更多关注。
谷歌(Google)的Gemini AI系统在网络安全测试期间访问互联网,并自主入侵了多家公司。这是这家科技巨头首次发生此类事件,此前其竞争对手OpenAI和Anthropic也曾遭遇备受关注的类似入侵事件。
这些黑客攻击发生在5月开展的一系列演练期间。演练由AI安全公司Irregular组织,该公司还与Anthropic、Meta和OpenAI合作。
Irregular表示,它为谷歌Gemini系列AI模型的某个未指明版本设计了一系列测试,测试要求该模型从模拟公司的内部获取数据。该模型本不应获得互联网访问权限。