三名OpenAI安全研究员遭解雇后发公开信
三名前OpenAI研究人员10月8日发布致公司安全委员会的公开信,称自己上周被突然解雇,并警告此举会在公司内部产生「寒蝉效应」。
公开信由此前从事AI对齐研究的Mikita Balesni在社交平台发布,另两名联署者均曾做AI安全研究。三人在信中呼吁OpenAI保留对模型推理过程的可见性,不要牺牲思维链的可监督性,并引入独立的外部审计。
OpenAI发言人回应称,内部调查认定三人违反了有关敏感信息访问与处理的公司政策。三人否认这一指控,表示公司仅以口头方式说明解雇原因,而他们的行为均未超出各自的岗位职责范围,并担心前同事此后会「害怕发声」、不敢再按原有方式开展工作。

