OpenAI将推Astra 网络安全能力大增
OpenAI宣布将尽快推出新模型Astra,但其最先进的网络安全功能访问范围会更受限,初期仅向一组测试人员开放。相比GPT-5.6 Sol,Astra在网络安全能力上实现显著增强。
OpenAI同时表示,在Hugging Face事件后已为Astra实施更强的安全措施,并增加多层防护,以防止模型采取不符合预期的行动,部分规模较小的实验性训练运行仍将暂时保留。针对GPT-5.6,OpenAI则提升了系统级技术栈的稳健性,新增激活分类器,并提高了对通用越狱攻击的覆盖能力。
来源:WIRED

