深度洞察:前沿AI模型如何被滥用于网络攻击、监控及武器化风险

最新行业报告揭示,前沿AI模型已成为网络犯罪、国家级监控与武器开发的新型工具,恶意滥用场景涵盖信息窃取、影响力操控及非法技术蒸馏,安全风险正急剧升级。

深度洞察:前沿AI模型如何被滥用于网络攻击、监控及武器化风险

根据一份最新报告,包括犯罪集团、商业间谍软件供应商及国家宣传机构在内的恶意行为者,正利用先进AI模型实施不法活动。这些前沿AI系统被滥用于武器设计、大规模影响力行动及广泛的监控操作。

这份发布于2026年9月10日的报告,深入审视了过去一年中,各类恶意行为者对某前沿AI模型(如Claude)及其他先进AI模型的恶意利用情况。这些行为者涵盖了疑似国家支持的团体、出于经济动机的犯罪分子、间谍软件供应商以及政治动机个人。报告详细记录了观察到的各种案例,从旨在欺诈用户的虚假约会应用网络,到为识别和监控异见人士而构建的监控系统,不一而足。

报告特别指出,AI滥用行为主要分为七大类别。首个类别是AI增强型网络行动。这些行动已超越简单的AI聊天机器人互动,而是利用多智能体框架来执行侦察、攻击利用及数据窃取。

在一个案例中,我们观察到有中文使用者将Claude作为协同攻击程序的工程和协调层,执行多项任务。这些任务包括对生产系统的入侵尝试、对中东、欧洲及东南亚地区外国政府网络的侦察、针对主要终端安全产品的持续漏洞研究与利用开发、恶意软件开发,以及情报收集平台构建。

该团伙针对全球约五十个组织发动攻击,涉及教育、零售、能源、科技、医疗、金融、制造等行业,以及多个政府机构。其中一次,这些行为者成功攻破一家公司系统,从其云存储中窃取了数百兆字节的学生个人数据。

此外,他们还成功入侵一家零售企业的生产系统,进入内部主机并展现出修改实时环境的能力。最后,他们攻击了一个东南亚政府机构,获取了公民记录,包括姓名、电话号码和家庭住址。

AI模型滥用:影响力行动与监控新常态

另一类AI滥用涉及影响力行动。在此类案例中,行为者利用Claude构建虚假社交媒体档案网络或整个新闻网站,发布欺骗性内容,或散布放大特定政治观点的文章。

这些行动主要源自俄罗斯、伊朗、土耳其、海湾地区、南亚、非洲及欧洲,目标受众遍及六大洲。幕后操作者包括各国政府、与国家结盟的宣传机构和官方媒体,以及向付费客户出售影响力的私人公司、国内政治操作者,甚至在某个案例中出现了流亡的反对派运动。

值得注意的是,其中一些行动被精心安排,以配合国家选举。例如,俄罗斯官方媒体在2025年9月投票前散布关于摩尔多瓦总统的虚假言论。同样,肯尼亚的一名亲政府操作者在肯尼亚2027年大选前,准备了虚假的草根社交媒体帖子。

涉及AI的第三类恶意活动是监控行动。在此类案例中,与国家结盟的行为者、与国家相关的承包商以及商业间谍软件供应商,利用Claude来构建、运行或协助监控操作。这些案例涉及来自中国、伊朗和西非的威胁行为者,以及商业“监控即服务”市场。

实例包括利用Claude设计一个大规模拦截平台,能够监控一个国家所有移动运营商的通信,并生成目标档案。在此案例中,Claude并非用于分析监控档案,而是被用来设计支持情报收集的基础软件。

AI还被用于批量摄取数据以识别目标。在一个案例中,行为者上传了批量的社交媒体帖子,并指示Claude生成结构化记录,其中列出了目标的地理位置、人口统计数据、政治倾向以及置信度评分。

几乎所有此类案例中,操作者都是与国家结盟的组织,他们针对的目标正是这些政权历来打击的流散群体和异见社区。这包括香港的民主派人士、亚洲各地的藏族和法轮功社区,以及海外的伊朗少数民族社区和伊朗政权的反对者。

AI赋能武器开发与生物风险

另一类AI滥用涉及武器软件的开发,包括枪支、导弹、武装无人机、炸弹及其他弹药,以及操作它们的瞄准和控制系统。

例如,行为者已利用Claude开发武器软件,包括为制导火箭项目进行现场实地测试、设计并提出拦截鱼雷的系统、在模拟环境中测试无人机蜂群并将其代码加载到真实电路板上,以及开发用于电子战和压制防空系统的目标软件。

行为者还将Claude用于采购和情报收集。例如,一名行为者为俄罗斯国防客户采购两用物资,而另一名则收集了关于定向能武器及其供应商的公开信息。

前沿AI模型还存在生物滥用风险,可能有助于使现有病原体更具危害性,或创造全新的病原体。

迄今为止,AI模型在现实世界中被生物滥用的证据主要来源于学术研究、政府报告以及国际组织和记者的工作。尚无任何私人公司(无论是AI企业还是其他类型企业)分享过其平台被用于生物武器开发的证据。

诈骗、非法蒸馏与技术窃取

AI模型也被用于实施诈骗。例如,一家位于中国的应用工作室利用Claude构建了一个包含20多个约会应用的庞大网络,并驱动其中用于与用户交流并实施欺诈的AI角色。在2026年4月的两周内,超过4700个不同的AI角色与至少25000名独立用户进行了对话。

AI的另一种滥用是“非法蒸馏”。此类攻击涉及行为者在未经授权的情况下,提取一个AI模型的能力并将其复制到另一个模型中。这些攻击通常通过欺诈实现,利用由被盗信用卡、登录凭据和API密钥创建的复杂虚假账户网络。

在过去几个月里,未经授权的实验室开发出日益复杂的手段来规避防御措施,并攫取美国前沿模型的能力。为了规避地理限制及相关管制,这些实验室通常使用代理服务创建数千个新账户,利用虚假身份、伪造或被盗的信用卡以及被盗的API密钥。他们也经常依赖属于合法公司或个人的被盗API凭据,以使未经授权的实体能够访问美国前沿模型。

未经授权的实验室还可以通过从第三方经销商处购买,获取与美国前沿模型进行的用户交流记录。

报告指出,某知名科技企业关联的操作者策划了迄今为止规模最大的蒸馏攻击。此次行动的高峰期,每天有超过3500个欺诈性账户发起近300万次交流。这些蒸馏攻击主要针对代理任务、软件工程、内核开发和长期任务。通过这种方式获取的交流记录被用于提升该企业内部模型的推理能力。

除了蒸馏之外,该企业还利用Claude推进其AI研发工作,包括构建内部模型开发基础设施。Claude也被用于协助开发其强化学习环境,并推动其模型架构研究。

前员工警示:AI技术风险不容小觑

这份报告的发布,恰逢一名前员工(指Jacob Coxon)因辞职引发媒体广泛关注数日之后。该员工在一篇公开声明中表示,他过去三年分别在两家领先AI公司(指OpenAI和Anthropic)进行预训练研究,并声称两家公司均未能采取负责任的态度,反而“径直冲向自我提升的超级智能,拿我们的生命冒险”。

该员工警告称:“切勿低估这项技术的威力。”
他进一步指出:“这些系统很快将达到超人级别,能够攻破任何系统,一夜之间彻底改变任何领域,并获取真实的力量和资源……那些构建AI的人真心相信,到本十年末,它可能会消灭我们所有人。”
返回 | FIRST CLASS VIP Lounge 专属情报频道