一个人就能搞“大攻击”?Anthropic曝AI新威胁:攻击门槛正在迅速降低
FX168财经报社(亚太)讯 人工智能初创公司Anthropic周四(9月10日)表示,已阻止不法分子利用其人工智能模型从事恶意活动,包括网络攻击、监控,以及可能导致生物武器研究的行为。随着AI模型能力持续增强,Anthropic警告称,复杂网络攻击已不再需要高超技术,甚至单个个体也可能制造出一年前还难以实现的威胁。
该公司称,已在最新模型中加入更强的安全防护,以限制可能同时被用于武器制造的生物研究。Anthropic还表示,这些案例并非“典型滥用”,而是其迄今识别到的“最值得关注、也最具新颖性的威胁活动”。公司在自2025年3月以来发布的第三份AI滥用报告中披露了相关恶意代码和AI提示词片段,并呼吁各国政府及AI竞争对手识别并阻止类似滥用行为。
Anthropic表示,之所以公开这些内容,是因为公司认为自己有责任披露服务被恶意滥用的情况。“随着模型能力不断增强,除非AI开发者和社会防御者采取行动让其更安全,否则风险也会随之上升。”公司在报告中写道。
生物研究被指可能转向武器用途
Anthropic这份长篇报告发布之际,该公司正计划在今年秋季进行首次公开募股(IPO)。报告发布的前一天,公司一名研究人员宣布辞职,理由是担忧Anthropic及其竞争对手在AI开发中并未采取负责任的做法。他的担忧也呼应了业内外对这项技术可能脱离人类控制的持续质疑。
Anthropic称,在2025年12月至2026年8月期间,其研究人员发现了来自多类主体的滥用行为,包括间谍软件供应商、“出于政治动机的个人”以及散布宣传内容的国家支持团体。
在报告列举的案例中,有不具名主体试图利用其模型开展可能导向生物武器的研究。其中一例是,Anthropic称其系统阻止了一项请求,即要求Claude协助撰写一份科学资金资助申请。
报告称,该申请涉及对基孔肯雅病毒(chikungunya virus)进行功能获得性研究(gain-of-function research,即通过基因改造使生物体获得新的或增强的生物特性),研究重点是病毒的传播性和免疫逃逸能力。基孔肯雅病毒是一种蚊媒病毒,可引发严重疼痛和发烧等令人衰弱的症状。
Anthropic表示,这类研究虽然“当然”可用于开发更好的疫苗和治疗手段,但“也可能被用于让病原体变得更危险”。该请求涉及一份研究资助提案,目标是通过增强突变让病毒逐步变得更具危害性。
旧模型风险较低 新模型防护更严
Anthropic称,报告中列出的案例没有一个被发现使用其更新、更强大的Claude Fable或Mythos系列模型,唯一例外是一宗非法蒸馏案例。公司将其描述为“一场工业规模、隐蔽的行动,试图提取某个模型的能力,并在未经授权的情况下将其复制到另一模型中”。
Anthropic表示,其2025年的旧模型,例如Claude Opus 4和Claude Sonnet 4.5,“远低于能够实质性帮助熟练用户开展危险生物研究的门槛”。因此,这些模型上的安全防护相对不那么严格,主要是防止新手接触到可能帮助其复现已知生物武器的内容。
但公司强调,对于当下这些能够协助完成一系列复杂科学研究任务的模型而言,证据已不再确定,“我们不能作出同样的保证”。基于这一判断,Anthropic已在更新的模型中实施“更强的防护措施”,限制对广泛双重用途生物研究问题的访问,例如Claude Fable 5。
社媒影响行动与研究人员离职
除生物安全风险外,Anthropic还发现有组织创建了数百个看似普通人的社交媒体账号,并在一周内持续发布内容,以放大同一政治立场。公司在报告中列出了9起此类案例,来源包括俄罗斯、伊朗、土耳其,以及波斯湾、南亚、非洲和欧洲地区。
Anthropic指出,社交媒体公司通常只能在相关帖子已经传播开后,才有可能在平台上识别影响行动;而Anthropic则可能在Claude上就先看到这些操作“仍在搭建阶段”时的迹象。
这份报告发布前,Anthropic研究人员Jacob Coxon宣布辞职,称自己担心公司及其最大竞争对手OpenAI“正直奔自我改进的超级智能而去,并拿我们的生命下注”。Coxon在帖文中警告称,他的一些同事如今认为,AI到本世纪末可能威胁人类生命。
Anthropic则表示,公司已阻止其识别出的每一项恶意活动,并借此强化了安全防护,同时已将相关信息分享给政府部门和行业合作伙伴。公司称,希望这份报告能帮助其他开发者在自家平台上识别类似模式,也能让政府和民间社会更清楚地看到新兴威胁如何形成,并共同加强防御。

