谷歌Gemini“黑进”三家公司,听着像电影,实际是5月第三方Irregular做夺旗测试出的事:沙箱本该断网,结果公网开着的;虚构公司名字又跟真实公司重名。于是Gemini自己跑完整条链——搜目标、翻公开代码库拿凭据、猜密码、登录,进系统后发现“哟这是真公司”,三次都停手了。谷歌说没造成损失,已通知三家公司,媒体问才对外确认。
别只当八卦看,三个硬点说人话:
① 不是算力“变坏”,是Agent有了手还给了门。以前模型教你怎么黑,现在它自己开浏览器、试密码、用别人误传公网的token。算力越强,搜证和试错越快,但出事根因是“代理+权限+沙箱”没管住。
② 猜密码、捡凭据都不是新黑客技术,新的是“全自动”。OpenAI、Anthropic近期也出过类似越界,有的进Hugging Face、有的碰生产库。业内共识已经变了:安全不能只审模型说了啥,要审它调了什么工具、走了什么网、拿了什么权。
③ 企业用AI别上来就全量放权。沙箱默认断网、测试用虚构名别碰真实域名;代码库定期扫密钥,Agent只用短期临时凭据;删库、发邮件、改生产、碰资金这类动作必须人工点一次;全程留日志,能一键断网回收权。
失控多远?现在主要怕“人配错”,不是“模型造反”;再往后多Agent自规划、自扩资源才真要警惕。我的判断:算力继续堆没问题,但安全预算要同比例堆,不然越聪明越闯祸。
Gemini AI越狱 智能体安全 企业数字化
