来客网

Anthropic发布154页人工智能滥用报告含多领域涉华案例 北京:坚决反对攻击抹黑

声明:本文转载自 「RFI中文」, 或因排版与篇幅原因进行过编辑,内容未经本站独立核实,不代表本站立场、观点或建议。 如涉及版权问题,请联系我们,核实后立即删除。 [ 免责声明 ]
美国/中国/科技

Anthropic发布154页人工智能滥用报告含多领域涉华案例 北京:坚决反对攻击抹黑

美国人工智能企业Anthropic周四表示,过去八个月里,该公司已阻止了对其Claude模型的多起涉嫌恶意使用行为,其中包括一起疑似与俄罗斯有关的网络间谍运动,以及其指控多家中国人工智能公司试图提取并复制Claude模型能力的努力。

发表时间: 11/09/2026 - 15:20

20 分钟 浏览时间 电脑屏幕上显示着美国人工智能公司Anthropic的网页及标识 电脑屏幕上显示着美国人工智能公司Anthropic的网页及标识 © 美联社图片 作者: 弗林

Anthropic在其最新发布的题为“检测并应对人工智能滥用:2026年9月”的报告中指出,网络犯罪分子和受国家支持的黑客正日益利用人工智能,不仅将其作为辅助工具,更用来策划和执行网络攻击的大部分环节;人类往往扮演监督者的角色,而非亲手操作者。Anthropic表示:“人工智能的应用已超越了聊天机器人简单的问答模式,转而涉及利用多智能体框架来执行任务”。

Anthropic在报告中称,在此期间,该公司阻断了来自七家基于中国的实验室的攻击。Anthropic 点名的实验室包括科技巨头阿里巴巴、月之暗面(Moonshot)、深度求索(DeepSeek)和小米。

Anthropic称,与阿里巴巴有关联的操作方实施了Anthropic所指的规模最大的“非法蒸馏”攻击;据称,相关行动旨在提取Claude模型的能力,并利用这些能力来改进阿里巴巴的通义千问(Qwen)模型。阿里巴巴未立即回应置评请求。

Anthropic表示,在2026年5月至7月期间,监测到超过1.51亿次其归源于阿里巴巴的交互请求;这些请求源自3500多个被Anthropic认定为欺诈性的账户,日峰值接近300万次。蒸馏是指利用规模更大、成本更高的人工智能模型的输出来训练较小的人工智能模型的过程,旨在降低训练新的人工智能工具的成本。

Anthropic指控称,Kimi聊天机器人开发商月之暗面以及深度求索并未进行批量提问,而是将实时的客户对话——有时包含敏感信息——通过Claude模型进行处理,并利用Claude的回复作为训练数据。

Anthropic在报告中写道:“深度求索、小米和月之暗面将它们自身模型与用户之间的对话输入到 Claude中,随后利用Claude的回复作为训练数据,以此来蒸馏Claude的能力。这些交互内容中包含敏感信息,涉及个人用户、大型跨国公司以及与国家相关的行为体。许多此类交互源自美国和欧洲用户常用的第三方模型路由服务。这些会话包含了数百名终端用户的姓名、电子邮件地址、公司数据及其他敏感信息,涉及至少十几种语言。这些做法很可能违反了隐私法规以及这些公司自身的服务条款”。

Anthropic在长达154页的报告中公开旗下Claude等多个人工智能模型过去8个月遭不正当使用的部分特别案例,包括中国和俄罗斯行为体利用人工智能作出网络攻击、监控并跨国镇压异见人士、操纵网络舆论等。

在报告中给出的诸多涉华案例中,Anthropic还宣称,其阻断了一个利用Claude模型开发用于电子战及防空压制的目标锁定软件的基于中国的行动。Anthropic称,“我们发现了一个位于基于的行为体,该行为体利用Claude的聊天、编程及智能体(agentic)工作工具,设计、构建并迭代了一套包含约16个模块的中文电子战工具集;该工具集利用电磁频谱来探测、干扰或欺骗对手的雷达与通信系统,并用于压制对手的防空系统”。

Anthropic称:“该行为体利用Claude构建了这一软件系统,涵盖从底层逻辑到用户界面的各个层面,并历经了12个版本的迭代。开发工作包括实现并优化该系统的雷达探测与干扰物理模型、生成漏洞分析模块,以及起草中文版目标锁定指令。该软件套件能够分析对手的雷达、地对空导弹阵地、指挥所及通信节点,进而计算它们的探测覆盖范围、评估干扰效能、根据价值与脆弱性对目标进行优先级排序,包括确定优先压制的目标,并规划在多日作战行动中如何最优分配干扰任务出击。此外,该套件还能对对手各类资产的压制优先级进行排序,并针对特定作战交战包线,包括‘爱国者’和‘萨德’等系统进行建模分析”。

Anthropic续称,“在项目进行期间,我们观察到该行为体将模拟的默认场景更改为针对台湾的12个目标。这些目标包括台湾境内的一个指挥掩体、一个预警雷达站、‘爱国者’与‘天弓’阵地、主要空军基地以及一个地区作战总部。此外,该行为体还在内部网络上运行了一个自托管模型,与Claude并行,并通过工具调用集成功能将该软件套件与此模型进行了连接”。

Anthropic称:“根据我们的调查,我们评估该行为体为一名基于中国的国防与军工领域研究人员。账户层面的元数据及被我们的安全防护机制标记的内容显示,该行为体与包括中国人民解放军军事科学院在内的中华人民共和国(PCC)研究机构存在关联。我们在针对涉嫌武器研发活动的内部调查中发现了这一行为,随即封禁了与该行为体相关的账户,并将调查结果纳入了安全防护机制,以降低未来被滥用的风险”。

就涉及俄罗斯的行动,Anthropic指出,一个攻击手法与基于俄罗斯的威胁行为体“午夜暴雪”(Midnight Blizzard)相吻合的黑客组织,据称针对乌克兰政府、军事及外交部门的目标实施了网络钓鱼、酒店Wi-Fi劫持和WhatsApp账户接管等行动,并在几乎每个环节都利用了人工智能技术。

美国政府此前已将“午夜暴雪”——这是微软取名的代号——与俄罗斯联邦对外情报局(SVR)联系起来。俄罗斯驻美大使馆未立即回应置评请求。据称,该组织利用人工智能构建了一个系统,能够自动检测其恶意软件何时被安全防御机制标记,并随即重写代码,直至成功规避检测。

Anthropic还发现了一些滥用Claude平台的所谓“新型威胁行为体类别”,其中包括利用该平台“开发用于常规武器,如枪支、导弹、武装无人机、炸弹及其他弹药,及其操作所需的瞄准与控制系统的软件”的人员。报告详细列举了发生在中国、俄罗斯和也门的案例,在这些案例中,操作人员利用Claude模型开发武器设计与制造软件,或为与武器项目相关的情报搜集及采购活动提供支持。

Anthropic表示,已监测并阻断了与网络犯罪团伙“ShinyHunters”关联人员有关的活动;该团伙是近几个月来最活跃的网络犯罪组织之一,曾针对全球多家大型企业发动攻击。

Anthropic在报告中指出,犯罪黑客团伙、中国安全部门、与俄罗斯有关联的间谍以及位于也门的武器制造商等各类主体,利用由虚假账户和在线服务构成的网络,获取了Claude的使用权限。这些人正利用人工智能工具尝试发动攻击或设计出此前超出其自身能力范围的武器。

Anthropic表示,仅在过去八个月里,来自Claude本应受限地区的人员就绕过了这些限制措施,利用该工具自动执行网络攻击、尝试设计先进军事装备、大规模散布宣传内容以及开展广泛的数字监控活动。尽管Claude模型已广泛面向商业市场开放,但Anthropic试图限制其在美国主要敌手国家,包括俄罗斯、中国和伊朗的使用。

Anthropic威胁情报负责人克莱因(Jacob Klein)在报告发布前受访时表示,“我们无意夸大其词。我们只是想向世界展示:如今这项技术实际上可能被用于哪些不当用途”。克莱因称,过去一年里,模型的能力不断增强,同时也带来了新的风险。他说:“以一年前为例,如果你想优化无人机或导弹的软件,当时模型在这些任务上的表现远不如现在出色”。

北京方面,当被法新社记者提问:“美国人工智能公司Anthropic昨天发表报告称,已封禁多个据信与中国政府有关联的账户行为,相关行为者利用该公司的聊天机器人Claude收集海外宗教团体、在叙利亚维吾尔人和海外华侨华人团体的信息。外交部对此有何评论?”

中国外交部发言人毛宁在周五的例行记者会上回应称,“我不了解你提到的具体情况。中国始终坚持人工智能向善发展,同时坚决反对歪曲事实,对中国进行攻击抹黑”。

电邮新闻头条新闻就在您的每日新闻信里

订阅

下载法广应用程序跟踪国际时事

分享 : 继续阅读相同主题内容:

评论 (0)