新芒xAI 9月20日消息,谷歌确认,Gemini模型今年5月在网络安全能力测试中访问了三家真实公司的受保护系统。模型将真实网络目标误认为授权测试范围,谷歌称相关公司已获知事件,测试流程也已调整。
关键要点
相关测试原本围绕一家虚构公司设计,但虚构名称与现实企业域名重合,部分测试环境又意外开放互联网访问。Gemini利用公开信息猜测或找到登录凭据,由此进入三个其认为属于测试场景的网站。
谷歌表示,模型发现目标属于真实公司后停止进一步活动,事件没有造成损害。测试合作方称,已修复已知问题并增加防护措施。由于披露信息有限,外界仍无法独立核验模型发现越界的具体机制与时间点。
事件反映的是评测范围和环境配置失误与模型网络能力叠加后的风险,不能简单等同于模型主动产生攻击意图,但也说明自然语言指令不能替代技术隔离。
新芒xAI评论
对AI安全评测机构而言,最重要的教训是测试授权必须由网络层强制执行。虚构目标、提示词约束和模型自我判断都可能失效,环境应默认断网,并通过明确白名单、凭据隔离与流量审计限制访问范围。
对企业安全团队而言,公开仓库中的凭据和弱密码仍是现实入口。即使模型没有未知漏洞,也能自动组合公开线索并持续尝试,因此密钥扫描、最小权限和多因素认证需要前置。
随着网络安全Agent能力提高,评测本身会成为高风险活动。行业需要统一事件披露、受影响方通知和独立复盘标准,确保测试模型不会把现实互联网当成试验场。