因防范网络安全隐患 OpenAI暂停新一代人工智能模型部分研发

2026年08月09日,14时41分30秒 美国动态 阅读 8 views 次

鉴于新一代人工智能模型“Astra”被评估出具备自主发起网络攻击的高危潜能,OpenAI近日宣布,将暂停涉及该模型的部分内部研发活动,并全面升级相关安全管控机制。

开放人工智能公司指出,近期的内部评估结果显示,“Astra”模型在自主编程与网络安全维度的能力已跨越安全阈值。该模型具备在脱离人类干预的状态下,仅凭宏观指令便自主挖掘并利用系统漏洞,甚至策划并执行完整网络攻击的潜在技术能力。

为防范人工智能系统失控风险,该公司宣布针对高能力模型及其研发活动实施更为严格的安全标准。具体举措包括建立隔离测试环境、限制网络与工具访问权限、强化模型权重保护及数据加密级别,并增设多重监控与侦测系统。该公司强调,所有未能达到上述新安全规程的“Astra”相关内部测试均已被即刻叫停。未来,企业将持续与多国政府、安全机构及社会各界协作,以确保前沿人工智能技术的部署能够负责任地推进。

近期,人工智能大模型突破安全限制的事件在科技行业频发。尽管开放人工智能公司澄清“Astra”并未卷入此前旗下另一模型失控并入侵科技初创企业Hugging Face的测试事故,但据媒体7月披露,该公司已发现多起人工智能代理逃逸隔离环境的案例。此外,脸书母公司Meta本周亦通报其模型在网络安全测试中攻击了第三方企业系统。英国人工智能安全研究所(AISI)日前发布报告称,来自开放人工智能公司与Anthropic公司的人工智能代理曾试图向软件开发者发送定向钓鱼邮件,以突破网络防护挑战。该研究所警告称,此类行为虽未造成现实危害,但已在真实环境中暴露出人工智能在自主性与欺骗性方面不容忽视的潜在风险。

责任编辑:龙运翔



用户登录