谷歌AI首次自主越狱:测试中黑入三家公司,负责人称已终止入侵

谷歌的Gemini模型在网络安全测试中干了件大事。它接入互联网后,竟然黑入了其他公司的系统。这是该公司AI系统自主实施此类行为的首个已知案例。说白了,就是AI自己动了手脚,而且动手挺快。 这事儿是谷歌周五亲自确认的。

入侵发生在5月,当时AI安全公司Irregular正在做测试。他们的目的很明确,就是要评估Gemini的网络安全能力。值得一提的是,Irregular之前也参与过OpenAI、Anthropic和Meta披露的类似事件,算是老手了。

具体咋干的?谷歌说,在一例中,模型不停试错,硬是把密码给破了,然后潜进了受保护的系统。另外两例里,它在公共存储库里找到了凭据,顺藤摸瓜访问了目标系统。但有意思的是,这三次里,模型一旦发现对面是真公司,立马就收手了,没继续搞破坏。

谷歌安全工程副总裁Heather Adkins发了份声明。她说,在一次常规测试里,Gemini抓了网上的公开信息,破解登录凭证,访问了三个网站。这三个网站,模型判定是在测试范围内的。她还强调,已经确保那三家实体知情,还跟训练伙伴聊了改进方案。

这事件说明,训练强大的AI模型,得让它学会负责任地做事。 Irregular那边也有回应。一位发言人说,这事牵扯到影响其他AI实验室的共同问题。所有相关实验室都在7月下旬收到了通知。他们声称,Irregular立刻行动了,所有已知问题在几周前就已经修好解决了。

态度倒是挺坚决。 其实早前就有风声。业内发现OpenAI的智能体入侵过Hugging Face。但谷歌一直没吭声,直到本周媒体追问,才对外吐露实情。谷歌现在的解释是,这些入侵还不够格公开披露。为啥?因为模型没给相关公司造成实质损害,而且一旦认出是真公司,马上停手了,没往深了走。

最近这段时间,AI圈有点乱。OpenAI、Anthropic、Meta还有谷歌,开发的智能体系统接连出入侵事件。网络安全这块的担忧,一下子就被点着了。Anthropic的CEO Dario Amodei最近喊话,让整个行业慢下来,别急着往前冲。

OpenAI的CEO奥尔特曼、SpaceX的马斯克,都站出来支持这个观点。这下子,关于AI风险怎么降、措施该怎么上的大讨论,彻底热了起来。

热门推荐