现在阻止科技被用作造成破坏的武器已经太迟,因此亟需大力投资防御措施。

过去两个月发生的一连串事件揭示了,当今最先进的人工智能对网络安全构成的威胁有多么严重。这些事件也生动说明,方向错误的政治行动最终可能非但无助于防御,反而会造成阻碍。

这一连串事件始于美国采取的一项措施:由于担心Anthropic最先进的新模型Fable 5可能被用于找出常用软件的漏洞,美国实际上阻止了该模型的使用。不过,这项措施后来被撤销。Anthropic随后表示,其他大量免费提供的AI也能做到同样的事情,其中包括至少一个以开放权重形式发布的中国模型;开放权重是开源软件的一种有限形式。

随后有消息称,OpenAI正在测试的一款模型找到了一种方法,可以突破限制进入互联网,并攻击在线代码库Hugging Face,以寻找其被要求解决的问题的答案。此后不久,英国人工智能安全研究所(AI Security Institute)、Anthropic和Meta也相继发布报告,称在各自的测试中发现了人工智能模型表现出类似的、疑似失控的行为。