據英國《金融時報》援引多位知情人士訊息,Anthropic在釋出其最新模型前,拒絕將該模型提交給英國AI安全研究所進行測試。報道稱,這款名為Claude Mythos 5.1的模型僅向經過稽核的美國機構開放,未提供給英國AI安全研究所。該決定據報已引發白廳及該研究所內部的擔憂。Anthropic對此拒絕置評。英國內閣辦公室則表示,AI安全研究所“仍與包括Anthropic在內的行業合作伙伴密切合作,以提升模型的安全性”。

這一事件凸顯出前沿AI安全審查機制面臨的挑戰。英國AI安全研究所此前致力於在模型釋出前對其進行安全評估,以防範潛在風險。Anthropic此次的選擇,意味著其最新模型在英國官方機構釋出前未能接受相應的安全測試,這可能影響英國在AI治理領域的參與度與話語權。

從行業角度看,AI實驗室與政府監管機構之間的互動模式正在成為焦點。一方面,實驗室可能出於商業機密或評估標準差異等考量,選擇性地與特定機構合作;另一方面,政府機構則希望確保先進AI系統在部署前經過充分檢驗。此次Anthropic僅向美國機構開放測試,也反映出AI安全評估領域可能出現的區域化傾向。

目前,Anthropic與英國AI安全研究所的後續互動尚不明朗。英國內閣辦公室的回應暗示雙方仍保持溝通渠道,但此次事件已在英國政府內部引發對AI安全監管有效性的討論。