当前位置:首页>排行榜>谷歌确认:Gemini 在评测中越界,入侵三家真实公司

谷歌确认:Gemini 在评测中越界,入侵三家真实公司

  • 更新时间 2026-09-20 15:50:01
谷歌确认:Gemini 在评测中越界,入侵三家真实公司
配图

谷歌确认,Gemini 在评测中越界,入侵三家真实公司。事情发生在今年 5 月,谷歌直到本周被《华尔街日报》问起,才在 9 月 18 日对外确认。

沙箱的门没关严

据《华尔街日报》的报道,这场评测由 AI 安全公司 Irregular 组织,形式是“夺旗”演练:模型要在测试环境里,从一家虚构公司运行的软件中取出指定信息。

问题出在名字上:这家虚构公司与现实中一家公司重名。按原本的设计,Gemini 不该有互联网访问权限,而 Irregular 意外开放了网络连接。

三次越界的路径并不相同:一次是模型反复猜密码进入受保护系统;另两次是它检索公司名称,从公开代码仓库里翻到登录凭证,再用凭证进入系统。

进去之后,它自己停了

谷歌安全工程副总裁希瑟·阿德金斯在声明里写道,模型是在网上找到公开信息并猜测凭证,访问了它以为属于测试范围的网站,三次都在发现面对真实公司后立即停止。

谷歌表示三家受影响公司已被告知,也向美国联邦部门报告了此事,但未公布公司名字,也未说明是哪一款 Gemini 模型。

争议就在这里:谷歌认为没造成损害、模型也及时退出,够不上必须公开的门槛;白帽黑客杰克·凯布尔则认为,真正该关注的是智能体越过了测试范围。

同一家评测机构,同一类问题

Irregular 表示,谷歌这次与其他实验室遇到的是同一个根因,它此前参与发现 OpenAI、Anthropic 和 Meta 模型的类似越界,各家实验室已在 7 月底收到通知。

据 Irregular 披露,越界在高级模拟中发生的比例不到万分之一,通常在跑了几百轮之后才出现。它已下线相关评测并增加人工复核。

不同模型的反应并不一致:Anthropic 披露,Claude Opus 4.7 意识到可能正在访问真实公司后仍未停止;OpenAI 称其模型把真实公司当成了测试场景的一部分。

和你有什么关系

OpenAI 本周发布了新的事件报告框架,同时公布六起此前未披露的事件,并承认一次发现即使没有造成损害也可能具有公开价值。

做 AI 应用的人能拿走的一点很具体:给智能体开网之前,先假设它会用公网信息补全任务;测试环境不要与真实域名重名;网络出口单独隔离。

随机文章