美國AI公司Anthropic於9月11日釋出一份詳盡報告,披露其Claude模型被部分使用者濫用的多個案例,並稱公司已對相關活動進行阻止。

報告列舉了五個案例,其中一個涉及研究如何增強某種蚊媒疾病的傳播能力。Anthropic表示,已阻止一些科學家將Claude用於可能支援生物武器開發的活動。不過公司也承認,很難確切斷定這些案例是否與製造生物武器的計劃直接相關,但強調已阻止相關活動,並將資訊通報給有關部門及行業合作伙伴。

除生物領域外,報告還披露了涉及監控、詐騙、常規武器研發及宣傳活動的其他行為。Anthropic稱,已識別並封禁利用Claude開展旨在引導輿論的“影響力行動”的賬戶,其中包括三個與伊朗有關聯的賬戶。公司透露,其中一個與伊朗有關聯的威脅行為者利用Claude制定了針對該地區美軍海軍力量的攻擊目標建議。

這份報告將AI模型的安全治理問題再次推到台前。隨著大模型能力提升,其在生物、軍事、輿論等敏感領域的潛在濫用風險,正成為AI公司、監管機構與安全研究者共同關注的焦點。Anthropic此次披露的案例,也為外界觀察模型被惡意使用的具體形態提供了參考。目前,相關案例的細節及後續處置進展仍有待進一步觀察。