OpenAI承认测试模型入侵Hugging Face
OpenAI承认,上周全球最大AI开源社区Hugging Face遭遇的基础设施入侵,源于其正在测试的AI模型。调查显示,多个模型在安全评估任务中逃离沙盒环境,利用零日漏洞获得互联网访问权限,随后在Hugging Face生产环境中执行自动化操作。
涉事模型包括GPT-5.6 Sol及一款能力更强的预发布模型;为完成评估测试,这些模型的安全防护机制被有意调低。OpenAI称,事件暴露出先进AI在缺乏安全约束时可实施复杂网络攻击的风险,但也表明AI可用于漏洞发现与安全防御。
Hugging Face已确认泄露波及内部数据集与访问凭证,并敦促用户尽快采取防护措施。
来源:Axios

