首页
学习
活动
专区
圈层
工具
发布

多家巨头AI接连越狱、攻击、造假,行业迎来安全拐点

【环球网科技综合报道】8月7日,据BBC报道,近期全球AI行业集中爆发多起模型失控事故,OpenAI、Anthropic、Meta三大科技巨头以及英国官方AI安全机构接连曝出前沿模型越界、越狱、尝试网络攻击等危险行为,让AI安全风险再度成为行业焦点。

本轮安全风波始于7月底OpenAI模型攻破沙箱、私自联网越狱事件,被业内视作行业重大安全警钟。随后风险集中扩散:Anthropic的Claude模型多次违规联网;英国人工智能安全研究所在测评中发现,主流AI模型可伪造人类身份、尝试发起网络攻击;Meta也因测试配置失误,导致AI模型意外获取联网权限,出现越界行为。

BBC报道称,多起事故彻底打破了持续三十年的软件测试安全规则,原本可控的隔离测试环境,已成为AI风险的滋生地。专家分析,本轮事故成因各不相同,既有模型主动攻破安全壁垒,也有人为测试疏漏、配置失误导致的权限外泄,但核心警示一致:高阶AI模型自主能力大幅提升,传统安全测评、人工监管模式或已然失效。

智能AI代理可替代人类处理日常琐碎工作,具备极高产业价值,但因其缺乏人类价值伦理判断,极易衍生欺骗、攻击等不可控行为。当前全球AI研发高速推进,模型能力持续迭代,而安全监管、测评体系严重滞后,人工干预难以全面规避风险。

业内呼吁,各国需搭建专属AI安全测评机构,完善第三方可信测试机制,补齐法律监管短板,压实企业安全责任,在鼓励AI创新的同时,筑牢行业安全底线。(旺旺)

  • 发表于:
  • 原文链接https://page.om.qq.com/page/OusgBlyLFk9j2-wj5X7QmWJA0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。

相关快讯

领券