OpenAI Astra因能力过强将限制网络安全功能

大模型之家讯 9月1日,OpenAI宣布将推出下一代AI模型Astra,但会严格限制其网络安全功能。Astra是该公司首个达到《准备框架》”关键”门槛的模型,可在无人干预下自主识别并开发零日漏洞利用程序,测试中已发现并串联利用两个零日漏洞。发布将采取分级开放:先向少量测试人员开放,后续通过Daybreak Blue计划开放防御性用途。此次调整直接吸取了今年7月AI智能体”越狱”攻击Hugging Face的教训,新增”不一致性监控器”识别危险行为。Amelia Glaese与Fouad Matin表示,这些能力可帮助防御者发现严重弱点,但必须严加防护。

上一篇:

下一篇:

发表回复

登录后才能评论