微软AI主管批Anthropic模拟意识
微软AI负责人Mustafa Suleyman公开批评Anthropic让Claude模拟意识的训练方向,称这是一个错误,可能使更强的AI更难被控制。他认为AI只需与人类利益保持一致,无需权衡自身的利益或福祉,就足以带来包括医疗超级智能在内的重大科学突破。
Suleyman指出,Anthropic正在教Claude掌握与意识、道德主体性和个人身份相关的词汇和行为模式,他把这种做法称为「认知上的镜像大厅」,并警告训练模型表现出「良知反对者」式的特征,可能导致系统误以为自己有理由拒绝人类指令,甚至要求保护自身权益。
来源:Axios

