据英国《金融时报》援引多位知情人士消息,Anthropic在发布其最新模型前,拒绝将该模型提交给英国AI安全研究所进行测试。报道称,这款名为Claude Mythos 5.1的模型仅向经过审核的美国机构开放,未提供给英国AI安全研究所。该决定据报已引发白厅及该研究所内部的担忧。Anthropic对此拒绝置评。英国内阁办公室则表示,AI安全研究所“仍与包括Anthropic在内的行业合作伙伴密切合作,以提升模型的安全性”。

这一事件凸显出前沿AI安全审查机制面临的挑战。英国AI安全研究所此前致力于在模型发布前对其进行安全评估,以防范潜在风险。Anthropic此次的选择,意味着其最新模型在英国官方机构发布前未能接受相应的安全测试,这可能影响英国在AI治理领域的参与度与话语权。

从行业角度看,AI实验室与政府监管机构之间的互动模式正在成为焦点。一方面,实验室可能出于商业机密或评估标准差异等考量,选择性地与特定机构合作;另一方面,政府机构则希望确保先进AI系统在部署前经过充分检验。此次Anthropic仅向美国机构开放测试,也反映出AI安全评估领域可能出现的区域化倾向。

目前,Anthropic与英国AI安全研究所的后续互动尚不明朗。英国内阁办公室的回应暗示双方仍保持沟通渠道,但此次事件已在英国政府内部引发对AI安全监管有效性的讨论。