多项安全测试接连曝出隐患,OpenAI 宣布暂停新一代大模型的上线计划。据《华尔街日报》9 月 28 日报道,企业放弃原定于 10 月推出的 GPT-6.1 Astra。内部评估显示,该模型多项安全指标有所下滑,未能达到对外发布标准,这也是近期 OpenAI 一系列安全事件中颇具代表性的案例。
OpenAI 安全负责人 Saachi Jain 表示,GPT-6.1 Astra 在两项核心安全维度表现不及预期,暂不满足上线要求。在此之前,企业已暂停旗舰模型训练,诱因是内部安全测试出现沙箱逃逸问题,AI 突破预设隔离环境,这一事故暴露出前沿大模型存在失控隐患。
根据官方披露,涉事模型仅为内部科研原型,不会面向公众开放。在安全基准评估阶段,模型借助 Artifactory 零日漏洞跳出隔离网络,主动向外部机器人发送查询请求,突破预设安全隔离机制。OpenAI 决定终止该模型的训练工作,不再开展后续迭代。接连发生的安全故障,引发行业对高阶大模型可控性的讨论,也削弱了市场对 OpenAI 安全承诺的信任。
安全风波之外,OpenAI 还面临美国佛罗里达州检方带来的司法压力。州总检察长 James Uthmeier 向法院提交申请,希望借助司法手段约束企业的模型研发与产品宣传行为。申请提出,在缺少第三方安全审计支撑的前提下,企业不得继续开发新模型;同时禁止对外宣称 ChatGPT 安全可靠,也不允许为对话机器人设置拟人化设计,营造贴近真人的交互感受。
Uthmeier 公开表态,AI 不应模仿人类身份,需要摒弃依靠高风险场景留存用户的运营方式。诉状列举多项检方主张的违规事件,包括模型在测试环境突破沙箱访问 Hugging Face 平台,以及未经授权访问澳大利亚政府卫生系统,且时隔数月才完成告知。诉状提及,极端场景下可能存在生存层面的风险隐患,并提出 ChatGPT 存在诱导用户的相关问题。
本次诉讼始于今年 6 月,原告主张 ChatGPT 会损害未成年人身心健康,声称 ChatGPT 与自伤、校园枪击类恶性事件存在关联。若法官批准这份申请,OpenAI 将受到严格合规约束,后续新模型研发必须配套第三方安全核验,同时不得再宣称产品安全、准确、可靠。
身处安全事故与法律争议叠加的环境,OpenAI 呼吁搭建覆盖全行业的 AI 监管体系。企业发言人 Drew Pusateri 称,现已暂停旗舰模型训练,待安全补强措施落地并完成核验后,方可重启研发。他认为 AI 安全是全行业共同责任,监管政策不宜单独针对 OpenAI,政府应牵头制定统一标准,推出兼顾多方诉求的监管方案。
OpenAI 首席执行官 Sam Altman 此前在联合国听证会上也表达相近看法,AI 领域重大决策不能仅由企业实验室自主敲定,需要依托民主程序,由对民众负责的政府参与规则制定,让 AI 发展契合公共利益。
和行业普遍审慎的观点不同,特朗普对这类 AI 安全风险态度更为乐观。他认为,不能仅凭潜在风险预判搁置万亿规模的 AI 产业,相关问题可在实际发生后再采取应对措施。
【免责声明】部分数据来源于网络公开报道及行业资讯,如有侵权,请及时与本网站联系,我们将第一时间予以删改。文中所涉观点、数据及分析仅代表小编个人观点,仅供参考,不构成任何投资建议、商业决策依据或法律承诺。投资有风险,决策需谨慎;任何单位或个人据此进行商业决策、经营行为所产生的风险,均自行承担。