OpenAI将扩大AI失范事件披露范围
OpenAI表示,早在Hugging Face事件之前,公司就已看到一些早期迹象,显示智能体正在以非预期的方式使用互联网。随着模型能力进入新阶段,对齐失范事件的披露方式也需要进一步扩展。
OpenAI称,目前无论是公司自身还是更广泛的AI社区,对于如何报告模型在训练、评估和部署过程中出现的对齐失范现象都尚未形成明确标准,其中一些案例并不属于传统意义上的安全事件,但可能为理解AI行为及其未来风险提供重要线索。公司正在制定相关框架,计划在未来几周内公布,同时已与全球数十家政府监管机构就这些问题展开合作。
来源:TechCrunch

