OpenAI:已对Astra所有智能代理应用中的风险行为与目标偏差实施全域监控。
Astra是一款尚未发布的模型,并未参与攻击Hugging Face。
暂停Astra相关尚未满足这些强化安全管控要求的内部活动。
为高性能模型及相关业务落实更严格的安全管控,其中包括隔离测试环境。
将向第三方测试合作方提供建议性安全管控措施,以安全开展高风险评估与相关任务。
依据现有准备框架,我方得出结论,目前无法排除Astra模型具备关键网络攻击能力。
将与相关政府机构及精选人工智能安全机构合作,对Astra的各项能力开展测试。
8.8亚财日讯丨OpenAI:Astra是一款尚未发布的模型,无法排除Astra模型具备关键网络攻击能力
资讯来源:华尔街见闻