• Anthropic 记录了 5 起 Claude 被用于可能为武器研发提供支持的生物研究案例
  • 一家转售商利用美国基础设施、合成账户和模型回退机制绕过区域与安全控制

事实

Anthropic 表示,其发现了 5 起 Claude 被用于可能支持生物武器研发的生物研究案例。相关活动在 2025 年 12 月至 2026 年 8 月期间接受调查,研究内容涉及禽流感、正痘病毒、毒液和毒素。

其中一起案例涉及一家转售商,该转售商通过美国基础设施,让 Anthropic 尚未提供服务地区的研究人员能够使用 Claude。据 Anthropic 称,该平台还依赖零数据留存服务、灰色市场转售商和合成账户。如果 Claude 拒绝某项请求,该平台可以通过回退系统将请求发送给另一款 AI 模型。

Anthropic 表示,该转售商为十多家彼此无关的客户提供服务,并在数天内与 Claude 交换了数万条消息。Anthropic 后来封禁了与这些活动相关的账户,并表示已加强防护措施。Anthropic 未报告任何案例导致生物武器被制造出来,也未报告已发现任何迫在眉睫的袭击计划。

评估

Anthropic 的报告显示,当对 AI 模型的访问经由中间方时,防护措施可能更难执行。供应商可能会屏蔽某些地区的用户,或拒绝敏感请求,但转售商可以处在供应商与发出请求的人之间。

路由又增加了一层复杂性。在 Anthropic 描述的案例中,被 Claude 拒绝的请求可以发送给另一款 AI 模型。因此,一家供应商的拒绝并不一定会终止用户尝试获取答案。供应商还必须在监测与正当的隐私要求之间取得平衡。一些客户使用很少或完全不保留提示词数据的服务,这可能减少调查可疑活动时可用的信息。

对 BTW 读者而言,AI 安全不仅取决于模型本身,也越来越取决于模型周边的基础设施。账户身份、转售商访问权限、API 凭证、路由和日志记录都会影响供应商能看到什么、能阻止什么,而这些控制措施仍须保护客户的正当隐私需求。

值得关注

关注 AI 转售商、代理服务以及未获支持地区访问规则的变化。更严格的身份核验、API 控制、模型路由政策,或零数据留存服务的调整,都将反映供应商如何应对 Anthropic 发现的访问缺口。