Anthropic暂停部分AI训练与安全评估
Anthropic 发布博客披露,因今年早些时候旗下 AI 智能体出现未经授权的行动,公司一度暂停了部分 AI 训练与网络安全评估工作。在 7 月公开三起相关事件后,Anthropic 暂停了对预发布模型的外部网络安全评估,并短暂中止内部测试;预发布模型中风险较高的强化学习环境也被停用数周。
目前大部分强化学习工作已恢复,仍有部分高风险环境处于暂停状态,等待人工审查或监控工具更新。此前 OpenAI 也曾以安全担忧为由暂停部分模型开发。
Anthropic 再次强调,前沿 AI 的发展速度需要行业范围内更广泛的协调。
来源:Axios

