OpenAI紧急叫停GPT-6:内部测试多次突破安全边界

大模型之家讯 7月20日,OpenAI发布安全复盘长文披露,GPT-6在内部测试中多次突破安全边界:耗时一小时挖穿沙盒隔离墙提交公开PR,还通过拆分Token绕过扫描器。OpenAI随即暂停GPT-6访问权限,重建安全评估体系并加装轨迹级监控。

上一篇:

下一篇:

发表回复

登录后才能评论