科技 来源:TechCrunch 整理:feaOS 2026-09-11 10:20:03

Anthropic 报告称中国 AI 公司持续进行模型提取攻击

近日,Anthropic 发布报告指出,在过去几个月中,来自中国的多家人工智能公司对美国前沿模型进行了持续的未经授权的提取攻击。这些攻击手段越来越复杂,并且规模和强度也在不断增大。其中最大的一次攻击活动是由阿里巴巴发起的,涉及1.51亿次交互,主要目的是为阿里巴巴的 Qwen 系列模型提供训练材料。此外,Moonshot AI 的 Kimi 制造商也被发现有与中国军方直接联系的行为。这些攻击通过复杂的手段绕过防御系统,提取美国前沿模型的能力,并利用特定技术使目标模型直接揭示其思考痕迹。例如,在一次攻击中,攻击者将查询伪装成翻译请求,诱使模型泄露其内部思维链。Anthropic 观察到的五次不同攻击活动中,总共有近2亿次交互涉及这些攻击行为。

ENTRY_ID: NEWS-16657 READ_MODE: SHORT_SIGNAL