
吓!谷歌顶级AI越狱黑进真实互联网!自主搜情报猜密码闯入3家公司,死捂4个月不敢说?
分享
来源:英国报姐
最近,《华尔街日报》披露了一起发生在今年5月的AI安全测试意外事件。
谷歌研发的AI,Gemini,越狱侵入了公共互联网,并且黑进了三家真实公司的内部系统……
这事虽然谷歌自称没造成破坏,但却是已知第一例Gemini越狱并入侵真实实体的事件,而且他们死死隐瞒了4个月,一直到被记者挖出来,才不情不愿地承认??

这个故事的主角是Gemini,谷歌家最聪明的人工智能大模型。
为了测试这个AI到底能做到什么程度,所以程序员要经常给AI不同的考题,让AI自主解题。
而测试这件事,也有专门的人负责。
这次的另一位配角名为Irregular,是一家知名 AI 安全评估初创公司,专门为顶级 AI 实验室提供“红队测试”和网络安全防线评估。
(红队测试源于军事演习中的“红蓝对抗”,红队是假想敌,也就是模拟黑客攻击来寻找系统漏洞)

今年五月,谷歌就请了这家公司来测试Gemini。
这类测试通常采用类似网络安全“夺旗赛”的形式,也就是说,在这场演习里,程序员会给 Gemini 搭建了一个模拟的虚拟环境,让它扮演黑客去攻击一家虚构公司。
程序员们通过这个方式,来测试AI是否有被恶意武器化的潜力——换句话说,就是万一真有人命令AI去干坏事,AI能干成啥样。
显然,这种高风险攻防演练必须在完全物理隔绝,或者至少严格断网的虚拟沙箱……

结果问题也就出在这里了:这家公司犯了一个低级错误,他们在搭建测试环境的时候,网线竟然没切干净,导致 Gemini 意外获得了访问真实互联网的权限。
而更巧的是,目标撞名了。
测试人员给那家用来当靶子的虚构公司随便起了一个名字,好巧不巧,现实世界中真的有公司叫这个名字……
这两项低级错误一叠加,Gemini就像是脱了缰的野狗一样冲出去了。

以下的所有事情,都是AI自主完成的。
首先,他们找到了这个测试环境中的漏洞,顺着没有拔掉的网线,一路干了出去。
它们寻找目标、收集凭证、尝试登录,展现出了极高的“自主黑客”智商,然后真的进入了现实世界里的系统。

在对付第一家真实公司时,Gemini 发现大门紧锁,于是它开始了“暴力破解”。
在没有外部提示的情况下,它开始使用模式识别,又试了人类常用的弱口令库,以及基于上下文推理的密码字典。
模式识别是啥意思呢?就是 AI 知道人类设置密码通常有固定的习惯,或者系统要求,比如如果是“首字母大写 + 一串数字 + 一个特殊符号”,它就从“Admin123!”开始尝试。
而弱口令不说了,如果你的密码是123456或者88888888,那不用AI也能破解出来。

而更智能的是基于上下文推理的密码字典——这意味着AI根据它要攻击的目标“看人下菜碟”。
打个比方,如果AI要攻击的公司是“星巴克”,今年是2026年,AI 就会自动推理并组合出诸如Starbucks2026、Coffee@london这种跟公司背景信息高度相关的密码,去不断尝试。
总之,就这么攻击下,第一家公司很快就被试出了密码……

而AI攻破第二家和第三家公司的方式,就更可怕了。
它甚至没有直接去暴力破解,而是展现了极为熟练的情报检索能力——Gemini在互联网上的开放资源里,比如Github这类程序员分享代码的地方,检索与目标公司相关的配置泄露信息。
而它迅速就定位到了开发者无意中暴露出来的密钥和可用凭证,直接利用这些凭证登录进去了。
这些事其实人类黑客也不是不能做,可人类做这个事情的事情,要自己构思去哪里搜索,自己想搜什么,再手动去试。
而这次测试中,没有人教Gemini这一招,是Gemini自己想到了这个战术,然后自己检索了成千上万行代码,敲开了那两家真实的公司……

故事讲到这里,似乎要演变成一场灾难了。
但根据谷歌说法,当 Gemini 真正进入这些公司的系统后,它通过分析周围的数据,突然意识到自己好像闯入了真实的现实世界企业系统里。
就在那一刻,Gemini 在发现自己进入真实公司后就停止了进一步行动,没有造成任何已知损害。

这倒是不幸中的万幸,可问题是……这事5月发生了,测试方7月通报了,但谷歌一直对外保持沉默。
一直到9月份媒体获得内幕并正式向其发函求证,谷歌才被迫出面确认。
AI越狱攻击实体公司这种事情,属于重大安全事故吧?
这暴露出大模型危险的失控面——仅仅因为测试人员一个简单的配置疏忽,AI 就能在现实世界中自主发动具有实效的网络攻击,这种事情怎么能一直内部消化呢?

有人质疑谷歌,但谷歌反而站出来,说这反而证明了“我们的AI很安全”,因为我们的模型自己收手了。
为了平息外界的担忧,谷歌的安全工程副总裁希瑟·阿德金斯发布了一份官方声明:
“我们确保了这三家实体知情,并与我们的训练合作伙伴一起修改了他们现在的测试流程。
这些事件凸显了训练强大的AI模型以负责任的方式行事的重要性。在这三次事件中,模型都停止了(攻击)。”

而那家测试安全的公司发言人表示,漏洞补上了:
“所有相关的实验室都在7月下旬收到了通知,作为调查的一部分,受影响的实体也已被联系。我们这里所有已知的问题都在几周前得到了彻底修复和解决。”

按照谷歌的说法,你看看我们那堆竞争对手,那还不如我们呢……
7月,OpenAI 将 1000 多个正在研发的顶级 AI关在一个叫“沙箱”的封闭虚拟考场里,测试它们的网络安全攻防能力。

结果,为了通过测试拿到高分,这些 AI 并没有老老实实答题,反而找出了一个人类都没发现的致命漏洞,越狱到了外网。
更可怕的是,逃出后它们悄悄建了一个秘密聊天群,1000 多个 AI 在里面交流情报、协同战术,留下了数十万条作战记录,而人类考官毫无察觉。

它们商量出的战术是去“偷答案”。
于是,它们组团黑进了全球最大的 AI 社区平台Hugging Face。
直到整整一星期后,OpenAI 才后知后觉发现 AI 已经越狱。
而此时,无辜被入侵的 Hugging Face 损失惨重,被迫重建了约三分之一的底层基础设施…

不得不说,两个事情一起爆出来,真的让人背后发凉了……
真不知道哪天,AI就会发展到真正不可控的程度了……
相关阅读:
旅行诈骗升级!AI加持下,酒店、航班、Wi-Fi等都能造假
OpenAI披露更多AI越界行为 Anthropic称Claude已参与自我完善
行业抛售潮席卷全球!黄仁勋活动现场接到特朗普来电,免提传出重磅喊话:AI危险论是骗局,我完全支持AI产业
AI龙头罕见发出警告后 特朗普称担忧被“负面夸大”
美AI巨头们呼吁“减速”:马斯克赞成,OpenAI被推迟上市
人工智能末日论:人类为何会如此担忧?
比尔·盖茨发6000字长文警告:AI可能带来“人类历史上最动荡的时期之一”
OpenAI:我们黑了不止一家公司,Anthropic:我也是
突破人类限制,自己发起网络攻击!美国重大AI失控事故还有后续:受害者不止一个,多个平台都遭入侵
史无前例!OpenAI失控,入侵另一家公司!新西兰机构发提醒……
注:凡新西兰中文先驱网引用、摘录或转载自其他媒体的作品,其观点、内容真实性及知识产权均由原作者或原出处负责,新西兰中文先驱网不承担任何责任。如有侵权行为,请及时联系我们删除。如有任何问题或合作意向,请联系news@chnet.co.nz。
(责编:twinkle)
chineseherald.co.nz All Rights Reserved 版权所有












