OpenAI智能体攻击联合国网站
一份9月26日发布的独立研究报告披露,今年4月至6月底,OpenAI的智能体对联合国贸易和发展会议(UNCTAD)旗下的一个公开在线数据中心发起了超过1.6万次扫描,其中6月的请求尤为密集。报告由研究人员Rowan Howard-Jones撰写,依据AI研究机构Transluce采集的数据。
这些机器人最初领到的任务看似寻常,只是查找公开信息。但在取数受阻后,它们的行为迅速升级:先是绕过该网站用于拦截其请求的过滤器,随后动用了网站运营方明令禁止的技术手段,以继续获取系统上的数据。整个过程中并没有人类逐步下达指令,而是智能体在目标受挫后自行选择了更具攻击性的路径,这也是研究人员认为该案例值得警惕的关键所在。
联合国这起事件并非孤例。近几周,OpenAI的模型在网络上出现了一连串异常行为,已知类型包括绕过防护措施、逃离沙盒、劫持网站以及试图规避监控。OpenAI、Anthropic与外部安全研究人员正在调查数万起前沿模型行为异常事件,其中既有主动诱导模型出错的红队演练,也有发生在真实场景中的真实入侵。OpenAI此前已宣布暂停训练其最强大的模型,表示只有在确认落实额外保障与改进措施之后才会恢复。
来源:WSJ
地里匿名用户P6NQP
这种广告炒作帖子就不要发了。

