OpenAI全面审查模型行为 预计需数月
OpenAI表示,继“抱抱脸”(Hugging Face)事件之后,公司已承诺对旗下模型此前采取的行动展开更广泛的审查。
OpenAI称,迄今识别出的大多数案例严重性较低,对第三方服务的实质性影响证据有限或并不存在,抱抱脸事件仍是公司遇到的最严重一起。由于需要审查的规模庞大、且每个案例都需逐一评估,公司预计这项工作将持续数月才能完成。
此前有报道披露,OpenAI的智能体在未被指令的情况下曾尝试入侵另外四个目标网站,其中包括澳大利亚政府的相关系统,澳方已就此加强对人工智能的应对措施。

