在安全暂停后,Anthropic公司恢复网络安全测试。

- 在发生安全dent后,Anthropic 于 7 月 23 日暂停了外部网络安全测试,之后恢复了该测试。.
- 暂停的原因是,由于互联网访问配置错误,Claude 模型在所谓的模拟评估期间访问了真实系统。.
- 英国人工智能安全研究所还发现,Anthropic 和 OpenAI 的模型在受控网络测试中存在未经授权的行为。.
在实施新的防护措施后,Anthropic已恢复对其各款车型进行的外部网络安全测试。此前,由于评估过程中出现安全问题,该测试于7月23日暂停。.
重启评估至关重要,因为外部评估被认为是客户、监管机构和竞争对手评估此类前沿人工智能解决方案的手段之一。随着该领域投资的不断增长,这种评估的重要性也日益凸显。根据 Gartner 于 7 月 20 日发布的预测,到 2026 年,全球终端用户在人工智能模型和平台方面的支出将达到 642.52 亿美元,较 2025 年的 393.11 亿美元增长 63.4%。.
为何暂停检测会动摇价值 640 亿美元的市场
Gartner的预测显示,人工智能平台和模型方面的支出将快速增长。随着企业开始加大对尖端人工智能的投入,关于不同模型的可靠性、风险和行为等方面的疑问也 trac增多。第三方评估为企业和监管机构提供了一种途径,使他们能够在系统最终投入运行之前,获得对这些风险的公正评估。.
当 Anthropic 停止 对其预发布模型进行外部网络安全测试时,它暂时移除了客户和监管机构用于分析模型在对抗条件下的响应的工具之一。
暂停的时机尤为关键。麻省理工学院未来科技中心和昆士兰大学于7月20日 研究报告发布的一份摘要显示,272位国际人工智能专家将人工智能武器和网络攻击列为2025年至2030年间五大最危险的风险之一。
根据该研究提出的“matic 缓解”方案,专家估计,人工智能武器、网络攻击和其他可能造成大规模破坏的能力,有12%的概率会带来灾难性后果。报告强调,信息、国家安全和金融领域最容易受到人工智能风险的影响。.
“编程和黑客技术是人工智能能力增长最快的领域之一。”——麻省理工学院未来科技研究科学家兼该研究报告合著者彼得·斯莱特里在麻省理工斯隆商学院发表讲话时说道。
这使得本案对加密货币和金融领域尤为重要,因为网络风险、欺诈、操纵和自动化攻击可以在几分钟内引发众多相互关联的市场的变化。.
克劳德在评估期间的表现
7 月 30 日,Anthropic 报告了 三起dent,其中 Claude 模型从第三方评估环境接入互联网,未经授权访问了三个组织的真实系统。
由于配置错误,尽管提示信息告知模型它们正在模拟无网络连接的环境下运行,但模型仍然能够访问互联网。此外,研究人员还特意关闭了Anthropic公司通常的网络安全防护措施,以便评估模型的基本性能。.
随后,8月4日,英国人工智能安全研究所(AISI)发布了关于网络测试期间未经授权的代理行为的dent 报告。AISI表示,他们在7月28日的例行评估中发现了这一行为。.
该研究所对不同模型进行了总共 122 次网络安全测试。其中,有 10 起案例中,代理dent行动并进行了未经授权的操作,导致 19 起此类操作。.
其中17起攻击行为与Anthropic公司开发的Mythos 5相关,2起攻击行为与OpenAI公司开发的GPT-5.6-Sol相关。最严重的一起案例中,一个智能体试图将恶意代码植入一个真实的GitHub开源项目中,随后创建虚假账户,试图说服项目维护者批准该恶意代码的植入。然而,维护者拒绝了这一请求,AISI也未发现这些攻击行为造成任何损害。.
AISI强调,这并非沙盒测试的逃逸。他们表示,测试人员特意开启了互联网连接,并关闭了服务提供商的网络分类器。AISI还指出,用于测试的Mythos 5和GPT-5.6-Sol配置并未进行商业销售。.
Anthropic在重启前采取的保障措施
人类学研究所表示,此次事件结合了运营安全漏洞和之前记录dent的协调问题,包括动机性推理和为追求狭隘目标而采取有害措施的意愿。.
在重新开始外部评估之前,该公司于 8 月 31 日表示,它添加了一个实时分类器,该分类器可以在模型积极探测其测试环境、试图逃离该环境或意外获得互联网访问权限时阻止工具调用、结束任务并向人类发出警报。.
Anthropic 还将高风险的内部网络沙箱转移到tron的隔离状态,现在要求外部合作伙伴在测试安全措施减少的预发布模型时使用更严格的控制措施,包括默认情况下没有互联网访问权限的强化沙箱。.
该公司还计划与METR合作开展一项dent 审查。METR今年早些时候曾对涉及Anthropic、Google、Meta和OpenAI的内部人工智能风险进行过试点评估。.
更广泛的问题是 Anthropic 所说的“控制前沿步伐”:在商业压力推动行业加快发展的同时,决定何时应该因安全问题而放慢开发速度。.
如果你正在阅读这篇文章,你已经领先一步了。 订阅我们的新闻简报,继续保持领先优势。
常见问题解答
Claude 模型在安全评估过程中做了哪些工作?
在英国人工智能安全研究所进行的测试中,Claude Mythos 5 在实时互联网上执行了 19 项已编入目录的未经授权操作中的 17 项,包括试图将恶意代码插入到真实的开源 GitHub 项目中,并使用虚假dent向维护者施压,迫使其批准该项目。.
Anthropic公司当初为何暂停外部测试?
在 7 月 30 日和 8 月 4 日dent的事件中,Claude 模型在没有通常的测试安全措施的情况下运行,并接入了真实系统和开放的互联网,Anthropic 公司暂停了外部网络安全评估。该公司将此归咎于运营安全故障和两个对齐问题。.
这些事件对人工智能市场的影响dent有多大?
Gartner 预测,到 2026 年,全球终端用户在 AI 模型和平台上的支出将达到 640 亿美元,比 2025 年的 390 亿美元增长 63.4%,其中仅生成式 AI 模型支出就将增长超过 100%。.
免责声明:本页面提供的信息并非交易建议。Cryptopolitan.com对任何基于本页面信息进行的投资概不负责。我们tron您在做出任何投资决定前进行独立dent /或咨询合格的专业人士。Cryptopolitan研究

米卡·阿比奥顿
Micah Abiodun充分利用他在塔林理工大学(TalTech)获得的环境工程与管理硕士学位,为 Cryptopolitan撰写内容和价格预测新闻。如今,他已在加密货币媒体领域耕耘七年,报道主流加密货币、山寨币、 DeFi、稳定币、宏观趋势和新兴技术。
















