OpenAI日前宣布,将对高性能模型及相关业务实施更严格的安全管控,其中包括隔离测试环境。这一举措旨在防范模型被滥用,并确保高风险评估在受控条件下进行。

据OpenAI透露,公司已对Astra所有智能代理应用中的风险行为与目标偏差实施全域监控。Astra是一款尚未发布的模型,并未参与攻击Hugging Face。同时,OpenAI已暂停Astra相关尚未满足这些强化安全管控要求的内部活动。

OpenAI还表示,将向第三方测试合作方提供建议性安全管控措施,以安全开展高风险评估与相关任务。这表明OpenAI在推进前沿模型研发的同时,正加强对外部测试环节的规范。

此次安全管控的强化,正值AI行业对模型安全与对齐问题关注度上升之际。OpenAI此举可能为行业树立更严格的安全标准,但也可能增加模型发布的内部流程复杂度。对于关注AI安全与治理的投资者而言,这反映了领先AI公司在商业化与安全之间的平衡考量。