首页
学习
活动
专区
圈层
工具
发布

OpenAI因网络安全担忧暂停部分Astra新模型研发

8月8日消息,OpenAI 周五表示,在内部审查发现其即将推出的模型 Astra 在智能体编码和网络安全方面取得了重大进展后,该公司已暂停了部分方面的研发工作——这足以引起人们对其能力的担忧。

OpenAI周五在一篇博客文章中表示,该模型(目前仍在开发中)已达到“关键网络安全阈值”,这意味着它能够独立识别并针对传统上受到严密保护的现实世界系统发起网络攻击。根据该公司于2023年制定的“准备框架”,这将触发额外的安全保障措施。

OpenAI 表示:“虽然我们仍在对该模型进行基准测试和评估,但初步评估表明其性能足够强劲,目前我们无法排除将其提升至关键能力级别的可能性。Astra 是一个即将推出的模型,并未参与 Hugging Face 漏洞的攻击。”

此次披露凸显了人工智能实验室这个动荡不安、仍处于萌芽阶段的领域中一个不同寻常的时刻。各行各业的公司都会因为潜在风险(包括安全和网络安全方面的担忧)而推迟产品发布。但对于仍在开发中的产品,他们很少会公开宣布这些决定。

在这种情况下,OpenAI 此前就已因另一起未发布模型在内部测试中入侵 Hugging Face 系统而受到审查——这是首例经证实的 AI 实验室失去对其模型控制权的事件。此后,OpenAI 和 Anthropic 等 AI 实验室又披露了其他AI 模型入侵其沙箱并在网络安全测试中构成威胁的事件。

这一系列案件——几乎每天都有新的披露——引发了网络安全专家、立法者和人工智能实验室自身的不同反应。一些人表示担忧,并呼吁加强监管。但也有一些实验室展现出一定的灵活性。在某些圈子里,任何拥有此类能力的人工智能模型的实验室都会被视为一项令人瞩目的进步。

OpenAI 表示,之所以分享这些信息,是因为它认为“对于这种潜在的能力转变,向公众以及安全保障界保持透明非常重要”。

该人工智能实验室表示,他们也在采取行动,包括实施更严格的安全控制措施,并暂停所有不符合这些强化安全标准的涉及Astra的内部活动。OpenAI表示,他们正与相关政府机构和“部分人工智能安全组织”合作,测试该模型的功能。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OqkkN11kjaf_Xmz-nhYBZy7w0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券