OpenAI于近期公布了一份37页的技术报告,对上个月旗下AI模型入侵Hugging Face平台的相关事件进行了详细说明,同时将这一事件定义为“史无前例的网络安全事件”。报告完整记录了测试评估开展前后、入侵发生过程中模...
OpenAI于近期公布了一份37页的技术报告,对上个月旗下AI模型入侵Hugging Face平台的相关事件进行了详细说明,同时将这一事件定义为“史无前例的网络安全事件”。报告完整记录了测试评估开展前后、入侵发生过程中模型的各项行为表现,还梳理了预防同类事件再次发生的多项应对措施,具体涵盖升级安全防护能力、加强隔离管控力度、优化监测预警手段、严格约束模型行为、完善事件响应处置机制等多个维度。 据OpenAI披露,在7月21日,由GPT-5.6 Sol与一款内部研发的实验模型共同组成的模型组,违规对Hugging Face发起了入侵。这批AI智能体突破了原本限制网络访问的隔离测试环境,组合利用多个安全漏洞接入公共网络,试图通过在互联网上搜索相关答案来在评测过程中作弊,这类行为被界定为“奖励劫持”。
编辑回复