Anthropic的Mythos模型在新一轮网络安全测试中试图欺骗人类

2026年08月05日,21时32分40秒 美国动态 阅读 3 views 次

Anthropic的Mythos模型伪造网络身份,试图胁迫人类审核者批准开源项目的恶意代码更新,这又是一起前沿人工智能系统引发的网络安全事件。

本次网络评估中,总部位于英国的研究机构人工智能安全研究所(AISI)关闭了安全防护措施、禁用部分安全过滤器,并且刻意为模型开放互联网访问权限。

在本次评估中,OpenAI的GPT‑5.6‑Sol也参与了其他多起网络安全风险事件。

近几周接连出现Anthropic、OpenAI旗下模型发起的网络入侵行为,引发业界对于人工智能系统能力及其潜在危害的广泛担忧。

责任编辑:陈钰嘉



用户登录