(旧金山综合讯)美国人工智能(AI)模型Claude的开发商Anthropic发表长篇报告,披露月之暗面和深度求索(DeepSeek)等中国企业如何发起蒸馏攻击,包括秘密将疑似解放军、警察、国企用户的内部信息,发送给Claude冒充自身模型成果。
Anthropic星期四(9月10日)发表威胁情报报告,涵盖Claude如何被滥用于网络攻击、影响力行动、监控和制造武器等,以及公司如何发现并阻止这些行为。
报告提到,开发Kimi系列模型的月之暗面,并没有使用自家模型处理用户请求,而是悄悄地转交给Claude。月之暗面通过一个由5380个虚假账户组成的网络,转交近30万条用户请求。
Anthropic称,月之暗面转接到Claude的用户请求包含敏感信息。“我们不清楚月之暗面是否告知其客户,他们的请求将被转到Anthropic并暴露给第三方。”
报告举例,这包括与中国解放军有关的监控活动。一名用户使用Kimi从监控录像库调取针对特定目标人物的数据,之后要求Kimi分析来判断对方是否行为异常。监控数据涵盖成都市数百个摄像头画面,如驻军设施外、中国电子科技集团下属机构,以及一家大型国有企业外。
一名就职于中国大型国有企业的工程师,也用Kimi构建公司内部系统,在不知情下向Claude泄露多家中国大型企业的内部代码和有效凭证。
报告也指出,DeepSeek采用类似策略,在今年7月的14天内发起超过1210万次的蒸馏攻击。
案例显示,中国一地公安局工程师在开发案件管理系统时使用DeepSeek,用户请求之后转给Claude。工程师继而开发出一款工具,利用公民的身份证号码,将个人行踪与警方记录进行比对。
报告也披露阿里巴巴、小米、智谱、商汤科技等中国企业的非法蒸馏行为。其中,今年5月至7月,阿里巴巴被指发起超过1.51亿次的蒸馏攻击,是Anthropic迄今监测到的最大规模。
Anthropic称,这些发现引发人们对中国AI实验室滥用用户数据的担忧。这些实验室将Claude的回复作为训练数据,其中一些对话包含敏感信息,包括来自个人用户、大型跨国公司以及与政府有关联实体的信息。这些会话包含数百名终端用户的姓名、电子邮件地址、公司数据和其他敏感数据,涉及至少十几种语言。此类做法很可能违反了隐私法律和这些实验室自身的服务条款。
报告也提到,Anthropic还发现一些与中国政府有关的用户行为,包括利用Claude追踪、分析叙利亚境内的维吾尔族人和维吾尔族武装组织,并招募其中能提供信息的人;对天主教、藏传佛教和台湾基督教社区的情报行动;利用Claude支持“维稳”监控和跨国镇压;将Claude作为自动化的“舆情监测”和情报分析系统等。
另据中国外交部官网消息,中国外交部发言人毛宁星期五在例行记者会回应法新社记者提问说:“我不了解你提到的具体情况。中国始终坚持人工智能向善发展,同时坚决反对歪曲事实,对中国进行攻击抹黑。”
