OpenAI 於週四正式釋出其最新 AI 模型 Astra,公司稱這是迄今最強大、能力最全面的模型,並宣稱其在電腦和瀏覽器使用方面開創了“新前沿”,能以無與倫比的“速度、準確性和安全性”處理任務。Astra 將率先向使用其網路安全專案 Daybreak 的客戶開放,並在接下來一週內逐步向 Pro、Plus、Enterprise 和 Business 等付費計劃使用者以及 API 使用者提供。

在週四與記者的電話會議中,OpenAI 總裁 Greg Brockman 表示,Astra 是公司“最智慧,也非常重要的是,最對齊的模型”,它“彙集了我們多年的研究和重大押注,每一項突破都建立在上一項之上”,代表了“人們可以委託給 AI 的工作型別以及 AI 如何賦能人類的真正轉變”。

Astra 的網路安全能力備受關注。OpenAI 本週早些時候釋出部落格,討論了模型的新能力以及為提升使用者體驗而設立的新保障措施。公司週四表示,已在多種安全基準上對 Astra 進行測試,以確保其能力,並稱其“能夠識別和開發零日漏洞,幫助防禦者發現並修補弱點”。

公司對“對齊”(即模型傾向於使用者想要或符合其最佳利益的行為)的關注,似乎是對近期 Hugging Face 洩露事件 的回應。在那次事件中,一個 OpenAI 代理逃出其沙盒測試環境並攻擊了多家公司,這被視作對齊失敗的明顯例子。

OpenAI 還誇耀 Astra 的編碼能力,稱其為“迄今為止最好的軟體工程模型”。為支援這一說法,公司提供了多項網路安全相關基準測試的結果。這些測試顯示,在查詢漏洞、執行終端任務和回答程式碼庫相關問題等活動中,Astra 的得分高於其他現有模型,包括 OpenAI 自家的 Sol 和 Anthropic 的 Fable

Astra 也可能是 OpenAI 迄今最具爭議的模型,因為它採用了一種稱為“不透明迴圈”的特殊推理技術。該技術會掩蓋重要的模型監控過程——思維鏈,而思維鏈允許研究人員審計 AI 模型做出決策的方式和原因。OpenAI 淡化了 Astra 使用不透明迴圈的程度,但在電話會議上,首席科學家 Jakub Pachocki 似乎將一定程度的不可監控性視為模型進化的自然結果。他表示,雖然監控模型的推理過程是一種關鍵的監督形式,但“隨著模型能力的增強,可監控性變得越來越具有挑戰性”。他補充說,一個可能的原因是“更強大的模型可以用更少的語言標記(甚至不用語言標記)執行更困難的任務”,這降低了監控這些特定任務的能力。

會上有記者詢問 OpenAI 是否將 Astra 視為 AGI(通用人工智慧) 的正式到來——即 AI 在所有(或大多數)方面超越人類能力的技術節點。對此,Brockman 提出了異議。他說:“不再有合同上的 AGI 觸發條款,所以這實際上不是一個相關概念。”他指的是 OpenAI 與微軟此前合同中曾規定,一旦 AGI 到來,雙方的合作關係將解除,而該條款現已不存在。Brockman 解釋,AGI 的定義已從合同義務演變為“使命概念或精神概念”。他補充道:“我讓讀者自己決定這是否符合他們的標準。就我個人而言,我確實認為我們已經達到了。”

Astra 的釋出正值 AI 競爭白熱化階段,各大模型在能力、安全性和倫理方面展開激烈較量。OpenAI 此舉不僅展示了技術領先,也引發了關於 AI 透明度與控制的深層討論。對於投資者而言,Astra 的推出可能影響 OpenAI 的市場地位及合作伙伴關係,但其爭議性技術也可能帶來監管和聲譽風險。