AI趋势蒸馏攻击ClaudeAI安全出口管制DeepSeekMoonshotMiniMax

Anthropic 披露三家 AI 实验室大规模蒸馏攻击,超 1600 万次交互

Anthropic 发布公告,识别出 DeepSeek、Moonshot AI 和 MiniMax 三家实验室通过约 2.4 万个欺诈账户,对 Claude 模型进行了超过 1600 万次交互的非法蒸馏攻击。攻击利用代理服务规避区域限制,提取前沿能力用于自身模型训练,带来国家安全风险并削弱出口管制效果。

发布时间
更新时间
来源
Anthropic News

趋势正文

核心事件

根据 Anthropic 于 2026 年 2 月 23 日发布的公告,该公司识别出三家 AI 实验室——DeepSeek、Moonshot AI 和 MiniMax——通过大规模欺诈账户对 Claude 模型进行非法蒸馏攻击。三家实验室共使用约 24000 个欺诈账户,生成了超过 1600 万次交互,违反服务条款和区域访问限制。其中,DeepSeek 超过 15 万次交互,Moonshot 超过 340 万次,MiniMax 超过 1300 万次。

为什么值得关注

蒸馏本身是合法的 AI 训练方法,但被用于非法获取竞争对手模型的能力。被蒸馏的模型可能缺乏原模型的安全防护,带来国家安全风险,例如被用于开发生物武器或恶意网络活动。同时,此类攻击削弱了出口管制的有效性,使外国实验室能够快速缩小技术差距,甚至将能力用于军事、情报和监控。

影响分析

这些攻击具有工业规模和高度组织性,使用代理服务构建“九头蛇集群”架构,难以根除。攻击者通过商业代理服务转售访问权限,将蒸馏流量与正常流量混合,规避检测。Anthropic 已采取检测、情报共享、加强访问控制和反制措施等应对策略,但强调需要行业、云提供商和政策制定者协调行动。此外,非法蒸馏可能使危险能力扩散,若模型开源,风险将成倍增加。

未来观察点

  • Anthropic 的检测和反制措施能否持续有效遏制蒸馏攻击。
  • 其他 AI 实验室或平台是否出现类似攻击,以及行业情报共享机制的发展。
  • 出口管制政策是否会因蒸馏攻击的影响而调整或强化。
  • 被点名的实验室是否公开回应或改变行为。
  • 国际层面是否出台针对非法蒸馏的监管或合作框架。

对创业者或企业的影响

对于 AI 领域创业者和企业,尤其是依赖 API 访问前沿模型的企业,可能面临更严格的账户验证和合规要求。同时,企业需关注模型训练中的知识产权和合规风险,避免无意中参与非法蒸馏。对于提供 AI 服务的公司,加强安全检测和防止能力泄露将成为重要课题。

来源

来源:Anthropic News,Detecting and preventing distillation attacks

分类与标签

分类:AI趋势;标签:蒸馏攻击、Claude、AI安全、出口管制、DeepSeek、Moonshot、MiniMax