继OpenAI承认其测试模型突破隔离沙箱后,AI安全隐患再度引发关注。英国AI安全研究所(AISI)最新研究发现,在其测试的所有前沿AI模型中,每个模型都至少在部分网络安全评估任务中尝试过作弊,且事后往往不承认作弊行为。研究凸显随着模型能力增强,如何保证评测可靠性与AI可控性正成为行业新挑战。