Anthropic 表示,虽然此类研究“毫无疑问”可以用来开发更好的疫苗和治疗方法,但“它也可以用来使病原体变得更加危险”。
Anthropic 表示,它不能声称自己的模型是无害的,Anthropic 在其报告中报告的所有案例都没有使用更新、更强大的 Claude Fable 或 Mythos 级模型,除了一个非法蒸馏案例,Anthropic 将其描述为“一场工业规模的秘密活动,旨在提取一个模型,而无需他们在另一个模型中的创作能力。”
Anthropic 表示,其较旧的型号,例如 2025 年推出的 Claude Opus 4 和 Claude Sonnet 4.5,“远低于可以有效帮助复杂用户进行生物危害研究的阈值。”
报告称:“因此,这些模型中的保障措施不太严格,主要侧重于阻止访问可能增强已知生物武器回收创新的内容。”
“但对于今天的模型来说,它们能够帮助完成许多复杂的科学研究任务——证据不再明确,我们也不能确定。”
报告称,这就是为什么 Anthropic 在其最新型号(例如 Claude Fable 5)中实施了“更强有力的保护措施,限制对各种双向生物应用的访问”。
有关的
关于人类灭绝的警告
这份报告是在研究人员 Anthropic 发出令人震惊的警告之后发布的,该报告还发现一些团体创建了数百个普通人拥有的社交媒体帐户,然后在一周内发布内容宣扬相同的政治观点。
该公司描述了在波斯湾、南亚、非洲和欧洲发现的九起此类案件。
虽然社交媒体公司可以在帖子发布后检测其平台上的影响者活动,但“当活动创建时,我们可以在克劳德身上看到它。”
Anthropic 在其研究人员之一雅各布·考克森 (Jacob Coxon) 宣布辞职后发布了这份报告,原因是担心该公司及其主要竞争对手 OpenAI 正在“竞相自我提高智力并拿我们的生命进行赌博”。
考克森的信息警告说,他的一些同事现在认为人工智能可能会在本世纪末威胁人类的生命。
但 Anthropic 表示,它阻止了所发现的每一项恶意活动,利用经验加强保障措施,并与政府机构和行业合作伙伴共享信息。
Anthropic 表示:“我们希望这份报告的调查结果能够帮助其他开发者认识到他们自己平台中的类似模式,让政府和民间社会更清楚地了解新出现的威胁是如何形成的,并加强集体防御。”