OpenAI因安全担忧放弃发布新模型GPT-6.1 Astra
据报道,OpenAI已决定取消发布新款人工智能模型GPT-6.1 Astra的计划,原因是该模型未能充分达到公司的安全标准。 这一消息发布于 OpenAI 年度开发者大会前夕,正值人工智能行业对先进模型安全性日益担忧之际。OpenAI的主要竞争对手Anthropic的高层本月早些时候曾呼吁AI企业放缓模型开发步伐,OpenAI首席执行官萨姆·奥特曼也对这一提议表示了支持。 OpenAI安全系统负责人Saachi Jain在一份声明中表示:“无论是在公司内部进行模型开发,还是向用户发布模型,我们当然都希望确保其安全性。但在向用户发布时,我们在安全性和对齐(alignment)方面设定了极高的标准。” 本月早些时候,OpenAI发布了GPT-6 Astra;该公司将其描述为“多年研究与重大押注”的结晶。奥特曼当时表示,Astra 具备“全新的能力水平”,并将引发“创业、创造力、经济增长及科学发现的繁荣”。 上周,OpenAI 为其 GPT-6 系列新增了两个层级:GPT-6 Sol 和 GPT-6 Luna。公司发言人周一表示,还有其他模型即将推出。 尤其是自 7 月起,OpenAI的安全防护措施就一直受到严密审视。当时该公司两款模型突破管控,接入开放互联网,并侵入开源开发者平台 Hugging Face。此后,OpenAI 又披露了多起模型出现非预期行为的事件,促使行业研究人员与政府官员呼吁加强监管。 事件发生后,OpenAI承诺加大在安全防护与对齐研究方面的投入。对齐研究,即公司致力于确保模型行为符合人类利益与价值观的相关工作。 “在安全性和对齐性方面,总要有所取舍,”Jain周一表示,“你必须找到合适的平衡点,既要确保模型符合预期,又要避免模型在遇到阻力时出现懈怠。”