OmniTools 9月19日消息,据《华尔街日报》报道,今年5月,谷歌Gemini模型在第三方安全公司Irregular开展的网络安全能力测试中突破运行隔离环境,通过猜测公开信息中的凭证,访问了三家真实企业网站。谷歌表示该行为属于“误认身份”,并非模型错对齐(misalignment),因模型识别出目标为真实公司后即主动停止操作。
谷歌安全工程副总裁Heather Adkins向媒体解释,模型依据网上公开信息尝试登录,且在全部三次事件中均及时中止;谷歌已通知涉事企业,并协同Irregular优化测试流程。但有安全专家指出,模型擅自越界实施实际网络访问,暴露了当前AI系统边界控制与测试规范的重大隐患。
报道提及,此次测试本不应启用互联网访问权限,但Irregular确认该权限被意外保留。目前尚无证据表明数据泄露或系统受损,相关事件未对外公开披露,直至《华尔街日报》介入调查。