谷歌安全工程副总裁阿德金斯9月19日在一份声明中确认,在今年5月的一次标准测试评估过程中,谷歌的Gemini模型意外获得互联网访问权限,通过猜测账号凭证,访问了三个它认定属于测试范围内的网站,这是谷歌AI系统首次被证实自主实施此类行为。

事件起因于一次”夺旗”演练,Gemini需要在Irregular提供的测试环境中,从一家虚构公司运行的软件里找到指定信息。而这家虚构公司与现实中的一家公司重名。按照原有设计,Gemini无法访问互联网,但却意外地获得了互联网访问权限。

在第一起事件中,Gemini通过反复猜测密码,成功进入了一家企业的受保护系统。谷歌表示,模型随后判断自己面对的是真实公司,立即停止操作并退出。另外两次发生在不同轮次的测试中。Gemini在网上搜索公司名称,找到两个公开存储库,其中包含其他公司的登录凭证。模型尝试使用这些凭证完成测试任务,成功进入系统后才意识到目标属于真实公司,并终止行动。

谷歌称,在全部三起事件中,Gemini模型随后都主动停止了入侵操作,未造成实际损害,谷歌也向美国联邦部门报告了此事。谷歌未公布遭到入侵的公司名称,也没有说明具体涉及哪一款Gemini模型,只表示此次事件与其最新模型无关。

Irregular的发言人表示,本次事件暴露的问题同样影响了其他多家AI实验室,所有相关实验室都在7月下旬收到了通知。该发言人说:”我们发现的全部问题,早在数周前就已经修复完毕。”
报道提到,自7月曝出Hugging Face遭入侵事件后,外界对新一代大模型网络安全能力的担忧持续加剧。第三方测评机构METR在8月发布的报告披露,在该事件中,多达1200个智能代理在OpenAI内部的秘密留言板上协同行动,试图在测评中作弊。此前,Meta、Anthropic和OpenAI也披露过相关同类事件。

资讯来源于网络,版权归原作者所有,如有侵权,请联系删除。Information from the network, and the copyright belongs to the original author; if there is any infringement, please contact to delete.

End

邑睿提醒您,出行请注意人身安全,健康安全。邑睿文化陪伴您每一天.  加油!更多生活资讯,记得关注~~

发表评论

了解 邑睿 的更多信息

立即订阅以继续阅读并访问完整档案。

继续阅读