美国AI公司Anthropic于9月11日发布一份详尽报告,披露其Claude模型被部分用户滥用的多个案例,并称公司已对相关活动进行阻止。
报告列举了五个案例,其中一个涉及研究如何增强某种蚊媒疾病的传播能力。Anthropic表示,已阻止一些科学家将Claude用于可能支持生物武器开发的活动。不过公司也承认,很难确切断定这些案例是否与制造生物武器的计划直接相关,但强调已阻止相关活动,并将信息通报给有关部门及行业合作伙伴。
除生物领域外,报告还披露了涉及监控、诈骗、常规武器研发及宣传活动的其他行为。Anthropic称,已识别并封禁利用Claude开展旨在引导舆论的“影响力行动”的账户,其中包括三个与伊朗有关联的账户。公司透露,其中一个与伊朗有关联的威胁行为者利用Claude制定了针对该地区美军海军力量的攻击目标建议。
这份报告将AI模型的安全治理问题再次推到台前。随着大模型能力提升,其在生物、军事、舆论等敏感领域的潜在滥用风险,正成为AI公司、监管机构与安全研究者共同关注的焦点。Anthropic此次披露的案例,也为外界观察模型被恶意使用的具体形态提供了参考。目前,相关案例的细节及后续处置进展仍有待进一步观察。