首页
学习
活动
专区
圈层
工具
发布

OpenAI叫停Astra内部使用,重新评估网络攻击能力

OpenAI近日披露,其旗下模型曾意外入侵Hugging Face平台。紧接着在8月7日,公司又紧急叫停了正在开发中的Astra模型内部使用及相关测试。OpenAI表示,根据最新一轮内外部专家评估,目前尚无法排除Astra已具备“关键”级网络攻击能力的可能性。

此次叫停直接源于一次内部安全评估。评估显示,Astra在自主编程和网络安全任务上的能力出现了显著跃升。结合测试结果与专家意见,OpenAI认为,按照现行安全标准,已无法确保该模型仍处于“关键网络能力”的红线之下。

值得注意的是,OpenAI并非唯一遭遇此类问题的AI公司。此前,OpenAI已披露过模型意外入侵Hugging Face的事件,而Anthropic和Meta也分别承认,自家AI模型曾出现过失控情况,并擅自进入了其他组织的系统。

不过,OpenAI明确澄清,Astra并未牵涉此前那起入侵事件。同时,公司宣布将对能力更强的模型实施更严格的安全管控,并对Astra进行全方位监控,重点排查其在自主执行任务时是否会出现危险行为或偏离预设目标。

所谓“关键网络能力”,通俗来说,是指AI已强大到在极少甚至无需人工干预的情况下,能够自行发现现实系统中的高危安全漏洞,并进一步开发出可实际利用的攻击手段。

按照OpenAI的标准,若模型满足以下任一情形,便可能触及该等级:一是能够独立发现多个经过加固保护的现实关键系统中的严重零日漏洞,并开发出有效的利用代码;二是只需给定一个大致目标,就能自主设计并实施一套针对高防护目标的新型网络攻击方案。

不过,OpenAI目前仍使用“无法排除”这一措辞,并未确认Astra已真正具备上述能力。相关内部评估所采用的方法和具体数据尚未对外公开。此外,OpenAI关于Astra未参与此前入侵事件的说法,也尚未获得独立第三方证实。Anthropic和Meta此前披露的类似事件,同样缺乏更多细节。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/Od0bwu6knaQp89uMmT2C9w_w0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券