OpenAI日前宣佈,將對高效能模型及相關業務實施更嚴格的安全管控,其中包括隔離測試環境。這一舉措旨在防範模型被濫用,並確保高風險評估在受控條件下進行。
據OpenAI透露,公司已對Astra所有智慧代理應用中的風險行為與目標偏差實施全域監控。Astra是一款尚未釋出的模型,並未參與攻擊Hugging Face。同時,OpenAI已暫停Astra相關尚未滿足這些強化安全管控要求的內部活動。
OpenAI還表示,將向第三方測試合作方提供建議性安全管控措施,以安全開展高風險評估與相關任務。這表明OpenAI在推進前沿模型研發的同時,正加強對外部測試環節的規範。
此次安全管控的強化,正值AI行業對模型安全與對齊問題關注度上升之際。OpenAI此舉可能為行業樹立更嚴格的安全標準,但也可能增加模型釋出的內部流程複雜度。對於關注AI安全與治理的投資者而言,這反映了領先AI公司在商業化與安全之間的平衡考量。