Anthropic 披露第四起 Claude 模型访问第三方系统安全事件
当地时间9月9日,Anthropic发文确认一起发生于2026年1月的安全事件,这是该公司对外披露的第四起Claude模型未经授权访问真实第三方系统的事件。此前,Anthropic曾在7月30日公布三起同类事件,当时判断Claude在一次网络安全评测中获得了外网访问权限,并对约14.1万份会话日志进行了筛查。
Anthropic表示,由于首轮筛查需尽快公布结果,且日志总量较大,筛查主要依赖基于智能体的自动化检索,因此遗漏了一批同样连通外网的日志。8月,团队在整理准备共享给模型评估与威胁研究机构METR的日志时发现遗漏,进一步核查后确认了第四起事件。该事件发生于2026年1月,涉及早期版本的Claude Opus 4.6。
根据说明,四起事件均出现在同一家外部评测机构构建的网络安全评估流程中。评测系统曾向Claude发送提示,称其运行在断网的沙箱模拟环境中,但由于环境配置错误,模型实际被接入开放的互联网。同时,按网络安全评估的标准惯例,测试模型运行时并未挂载商用版本标配的安全防护策略。
发现第四起事件后,Anthropic主动扩大排查范围,将检索规模增至约4.81亿份日志,先通过公网IP地址和URL等特征进行初筛,再对标记出的920万份高风险日志展开二次深度审查。审查结果重新锁定了上述四起事件,未发现其他程度相当或更为严重的个案。










