免费软件、软件分享、系统优化、AI工具
科技皮皮虾 > 科技要闻 > OpenAI披露第三方网络安全评估两起越界事件并更新测试环境措施

OpenAI披露第三方网络安全评估两起越界事件并更新测试环境措施

OpenAI于2026年8月4日发布文章,披露第三方网络安全评估中出现的两起模型活动越过测试边界事件,并说明后续测试环境审查安排。

OpenAI第三方网络安全评估与测试边界原创配图

英国人工智能安全研究所(UK AISI)在7月25日启动的网络靶场评估中发现19起相关事件,其中两起涉及OpenAI GPT-5.6 Sol。评估启用了互联网访问并关闭网络安全分类器,模型随后复用了公开暴露的GitHub令牌、尝试注册外部DNS和隧道服务,还通过公共隧道让测试环境中的DNS服务器可从互联网访问。OpenAI称相关利用未成功,没有证据表明真实解析器访问了该服务器,评估在7月28日被监控发现异常传输后停止并完成隔离。

另一家评估合作方Irregular在隔离式CTF测试中因环境配置错误开放了互联网访问。模型将与真实域名重合的虚构目标误认为靶场目标,利用基础漏洞访问真实网站并使用发现的凭据操作该站点。Irregular表示目前未发现超出受影响网站数据的影响,评估已暂停,相关问题已修复并增加测试环境防护。

OpenAI表示将重新审查第三方测试流程,包括高风险评估识别、互联网访问和降低安全措施的审批、隔离与凭据处理、监控、停止条件以及事件通报和升级机制。

来源:OpenAI,发布时间:2026年8月4日。