Anthropic最新报告:AI滥用从内容生成转向完整执行链,欺诈与攻击成本大幅降低
2026/09/11 17:48阅读量 2
Anthropic发布2026年9月威胁情报报告,揭示AI正从一次性内容生成转向参与网络攻击、监控及影响力行动的完整执行链。在约会应用中,4700个AI身份通过“AI聊天+真人验证”模式与2.5万用户互动,改变了欺骗成本结构;同时,AI被嵌入网络间谍、武器研发及生物研究等高风险领域,显著降低了专业门槛和运营单位成本。
事件概述
Anthropic于2026年9月发布《Detecting and Countering Misuse of AI: September 2026》报告,披露了2025年12月至2026年8月期间发现的AI滥用案例。报告核心指出,AI的角色已从提供建议或生成单次内容,转变为参与侦察、利用、持续交互等长链条任务,使得少数人即可低成本完成过去需多人协作的高风险活动。
核心发现
1. 约会应用中的“人机混合”欺诈新模式
- 规模与数据:一家位于中国的应用工作室运营20多款约会应用。在两周观察期内,约4700个由AI驱动的人设与至少2.5万名真实用户产生互动,生成约236万条Claude消息。匹配池中约四分之三的账号由AI驱动。
- 运作机制:系统采用“AI负责长期聊天维持关系 + 真人在视频通话等高风险节点介入验证”的模式。这种分工将单个真人维护关系的能力扩展至数千个虚假身份,并通过推动用户购买虚拟币实现商业变现。
- 影响:改变了传统网络欺诈的成本结构,使得大规模情感欺骗成为可能,且难以通过常规话术检测识别。
2. 网络攻击进入连续自动化执行阶段
- 技术趋势:攻击者不再仅利用AI解释漏洞或编写代码片段,而是将模型嵌入侦察、利用、恶意软件迭代等连续环节。
- 具体案例:一起疑似具有俄罗斯背景的网络间谍活动中,攻击者计划针对超过20家组织。当恶意工具被发现后,AI被用于修改代码并重新部署,确保持续攻击能力。
- 安全挑战:AI安全问题从“内容过滤”转向对权限、工具调用、日志审计及人工接管机制的管控,因为模型已具备在现实系统中连续行动的能力。
3. 监控、情报与武器研发的Agent化
- 监控与情报:
- 马里国家安全部门顾问利用Claude参与开发通信拦截平台。
- 与伊朗相关的活动使用Claude处理大量社交媒体信息,筛选特定账户进行持续分析。
- 武器研发:也门北部团队运行多个Claude实例,分别承担研究、编码和代码审查任务,用于制导火箭相关软件研发。在一次测试失败后,相关人员再次使用Claude分析问题。
- 生物研究风险:报告披露了5组涉及病毒功能增强、毒素改造等高风险生物用途的研究活动。由于生物研究具有双重用途(既可用于公共卫生也可用于恶意目的),难以简单界定其最终意图,增加了监管难度。
4. 影响力行动的自动化基础设施升级
- 案例:在与中非共和国相关的俄罗斯影响力行动中,Claude被用于生成广播材料、社交媒体内容及合同文件,并帮助内容贴近当地记者表达风格。
- 成本变化:写作、改写、本地化、资料整理和账号维护等环节被模型承接,导致组织一场持续影响力行动的单位成本大幅下降,可复制规模显著提升。
值得关注的关键结论
- 执行链延伸:AI滥用的边界正在从单点的内容生成延伸至完整的业务流程执行,包括攻击、监控、研发和宣传。
- 成本与门槛降低:通用大模型降低了专业技能的门槛,使得小团体甚至个人能够完成以往需要大型团队和专业背景才能推进的任务。
- 身份验证危机:“AI聊天+真人验证”模式模糊了数字身份的真实性,传统的基于行为模式的反欺诈手段面临失效风险,未来社交领域的核心规则可能转向强制性的身份披露。
- 样本局限性:报告所列案例为Anthropic发现的最具新颖性和值得注意的滥用活动,不代表Claude整体用户的典型行为分布,但反映了技术能力溢出后的潜在风险方向。
