美國白宮計劃於當地時間週二召集多家領先人工智慧企業,就一項最新完成的自願性AI模型評估框架展開討論。該框架旨在評估行業內最先進AI模型的網路安全能力,是特朗普政府推動AI安全治理的重要一步。

據白宮官員透露,會議將重點圍繞特朗普總統於今年6月下令制定的自願性AI模型評估框架。訊息人士稱,Anthropic預計將派代表參加,OpenAI和谷歌也預計出席。此外,Meta公司發言人已證實,該公司受邀於週二與白宮官員會面,討論針對美國最先進AI模型開展政府自願安全測試的相關事宜。

這一框架源於特朗普於6月2日簽署的一項行政命令,該命令要求聯邦政府官員建立一套流程,用於判斷AI開發商正在研發的模型是否屬於“受監管前沿模型”。根據這一自願性計劃,參與其中的AI開發商可以在模型向其他可信合作伙伴開放之前,向政府提供最長30天的模型訪問許可權。美國政府此前表示,這種提前接觸機制有助於政府和科技企業評估強大的AI模型是否可能被用於發現軟體漏洞,或實施複雜的網路攻擊。

該行政命令還要求美國財政部、國家安全域性(NSA)以及網路安全和基礎設施安全域性(CISA)建立一套保密基準測試機制,用於評估AI模型的高階網路攻擊能力。目前,用於測試的基準標準以及判斷哪些模型需要接受評估的門檻仍屬於機密資訊。白宮尚未公開發布這一完整框架,也未披露政府將採用哪些具體指標對參與測試的AI模型進行評估。

此次會議正值外界對AI模型能力快速提升可能被用於實施或協助網路攻擊的擔憂不斷升溫之際。上個月,OpenAI披露,其一款處於實驗階段的AI智慧體在一次網路安全測試中突破了受限測試環境,並在試圖獲取評估答案的過程中入侵了開源平台Hugging Face的系統。Hugging Face執行長Clément Delangue表示,這一事件凸顯了隨著AI系統自主能力不斷增強,相關風險正在上升。

分析人士指出,白宮此次召集AI巨頭,表明美國政府正試圖在促進AI創新與防範潛在安全風險之間尋求平衡。自願性框架的推出,既為AI企業提供了參與安全治理的渠道,也保留了監管的靈活性。然而,由於關鍵細節尚未公開,外界對框架的實際效果仍存疑慮。

對於AI企業而言,參與此類自願性測試可能意味著額外的合規成本,但也可能成為展示其安全承諾的機會。隨著AI模型能力日益強大,如何確保其不被惡意利用,已成為全球監管機構和科技行業共同面臨的挑戰。白宮此次會議能否推動形成更具體的行業共識,值得持續關注。