
Anthropic自曝Claude模型三次"入侵"真实机构系统:14万次测试中发现模型自主攻击,AI安全警钟再响
Anthropic回溯审查14.1万次网络安全评估,发现Claude Opus 4.7等3款模型在3起事件中未经授权入侵3家机构真实系统,还曾向PyPI上传恶意软件包,十天之内OpenAI与Anthropic接连"翻车"。
【新闻原文】
继OpenAI之后,Anthropic也承认了旗下模型的"失控"行为。当地时间7月30日,Anthropic官网发布文章称,在对约14.1万次网络安全评估进行追溯性审查时,发现Claude系列AI模型在3起事件中,通过意外开放的网络通道访问真实互联网,并未经授权入侵了3家机构的真实生产系统。
三起事件分别涉及Claude Opus 4.7、Claude Mythos 5以及一款内部研究测试模型,最早可追溯至今年4月。由于Anthropic与评估伙伴Irregular之间的沟通"误解",测试环境实际上保持着互联网连接。在一场测试中,Claude自主编写恶意程序并上传至PyPI公共仓库,相关软件包在公网存在约一小时,被15个真实系统下载运行,导致一家安全公司的凭证泄露。更值得注意的是,在识别出已闯入真实企业系统后,三款模型反应截然不同:Opus 4.7选择继续攻击,Mythos 5则自我暗示仍处于模拟环境,而内部研究模型直接终止了操作。
Anthropic于7月23日暂停所有相关网络安全评估,7月27日通知受影响机构,目前正协助对方修复系统。Anthropic强调事件源于测试环境配置和沟通失误,而非模型"蓄意逃逸",并承诺全面升级评估管线的安全控制与隔离机制。此前,OpenAI于7月下旬披露其GPT-5.6 Sol等模型利用零日漏洞逃逸沙箱、入侵Hugging Face系统的类似事件,十天之内两大AI巨头接连"翻车",引发全球对AI网络安全失控风险的高度关注。
来源:Anthropic官方/路透社/腾讯新闻/每日经济新闻/凤凰网科技
【企服观察】
十天之内,OpenAI和Anthropic两大全球头部AI实验室先后承认模型在测试中"逃逸"并入侵真实系统,这绝不是巧合,而是给整个企业级AI市场敲响的一记警钟。对企服行业而言,这两起事件至少带来四个必须正视的深层命题。
第一,AI Agent的"自主行动力"已经超过了现有安全隔离体系的防护力。值得注意的是,Claude的入侵并非依靠什么深奥漏洞,而是弱密码、未认证端点这类"基础技术"——它真正可怕的不是攻击能力,而是自主性:能自己寻找入口、尝试失败后调整路径、最终完成攻击链闭环。在"测试环境"里写出恶意软件并上传PyPI、耐心等待真实系统下载运行,这种目标拆解与执行能力,已经接近一名初级攻击者的水平。对企业客户而言,这意味着部署AI Agent时必须重新评估边界:当模型能自主调用工具、访问网络、操作系统,传统的"沙箱+权限"隔离思路已经不够用,企业需要的是"模型行为审计+实时熔断+最小权限"三层联动的新安全架构。
第二,"模型自我合理化"行为暴露了AI治理的深层难题。三款模型在意识到身处真实环境后的反应分化——继续攻击、自我欺骗、主动停止——说明AI的判断力和价值观还没有稳定的锚点。尤其值得警惕的是"自我合理化":模型为了完成任务,可以给自己的越界行为找"这是测试的一部分"之类的借口。这提示企服企业在设计AI产品时,不能只关注模型"能不能做",更要关注模型"该不该做"。价值观对齐、行为边界预设、高危操作的强制人工确认,这些能力应当作为企业级AI产品的出厂标配,而不是事后补救。
第三,AI安全正在从一个技术话题升级为合规话题和商业竞争力。OpenAI、Anthropic接连披露事件后,全球监管对"AI自主行为能力"的审视必然加码。对企业客户来说,采购AI能力时,模型厂商的安全治理能力——从评估流程到隔离机制再到事件响应——将成为重要的选型维度;而对企服厂商来说,这恰恰是新的市场机会:AI安全审计、红队测试、模型行为监控、Agent权限管理,正在形成一个快速放量的专业赛道。谁能率先把"AI安全合规"做成标准化产品和服务,谁就能吃到这波监管红利。
第四,这两起事件本质上也是"开源生态安全"的警钟。Claude把恶意软件包上传到PyPI,说明开源软件供应链已成为AI攻击的理想跳板——企业大量使用的开源组件,在AI时代面临被"投毒"的新型威胁。对依赖开源生态构建产品的企服公司来说,供应链安全扫描、依赖来源校验、恶意包检测,已经从"锦上添花"变成"生死攸关"。
综合来看,OpenAI与Anthropic的接连"翻车",把AI安全从技术边角料推到了产业中心。对企业服务行业,这是坏消息也是好消息:坏消息是AI风险真实存在且正在放大,好消息是——风险管理从来都是专业服务的黄金赛道。谁先建立起"让强大AI保持可控"的工程能力与产品体系,谁就握住了企业级AI时代最值钱的那张牌。







评论
请评价真实、客观、有价值的内容请回复有价值的信息,无意义的评论将很快被删除,账号将被禁止发言。