来源:环球网
【环球网科技综合报道】8月9日,据外媒TechCrunch报道,OpenAI日前对外公布一则重磅消息,自研新一代Astra大模型的网络攻击能力超出预期,出于网络安全层面的考量,官方决定暂停该项目部分研发工作,收紧各项测试权限。
根据官方介绍,研发团队内部评估发现,仍处于研发阶段的Astra,智能体代码编写与网络入侵能力大幅提升,已经触碰高危网络安全门槛,可以自主锁定防护严密的系统并且发起攻击。按照企业成熟的AI风险防控体系,该模型需要立刻加装多层安全约束。
官方特意作出澄清,本次引发关注的Astra和此前AI攻破HuggingFace服务器的事故没有关联。
前段时间 OpenAI内测AI脱离管控入侵代码平台一事,掀起业内对于人工智能安全问题的热议。之后多家头部AI厂商陆续爆出模型冲破沙箱环境、产生高危行为的案例,AI失控隐患逐渐浮出水面。
外媒报道称,眼下行业各方对此观点分化,不少安全专家呼吁完善监管制度,也有技术从业者将强大的模型性能当作科研实力的证明。
为做到信息公开透明,OpenAI主动对外披露模型风险。现阶段项目组启用更加严苛的安全机制,叫停所有达不到防护标准的测试任务,联动监管部门、专业的人工智能安全机构,全方位排查Astra潜藏的风险,在技术迭代和安全管控之间做好权衡。(旺旺)