OpenAI安全负责人称,GPT-6.1 Astra在安全方面出现倒退。
9月28日,据《华尔街日报》报道,OpenAI已取消原定于今年10月发布的最新AI模型GPT-6.1 Astra的上线计划。
该公司负责安全系统的高管Saachi Jain表示,GPT-6.1 Astra在两个领域出现倒退,尚不具备发布条件。这是OpenAI近期一系列安全事件中最新的一起。
与此同时,佛罗里达州总检察长James Uthmeier于本周一向法院提出申请,要求法官下令禁止OpenAI在缺乏第三方安全保障的情况下开发新模型,并禁止该公司将ChatGPT宣传为"安全"产品,或赋予其聊天机器人拟人化特征。
模型发布搁浅:安全测试暴露缺陷
GPT-6.1 Astra原定今年10月推出,但测试阶段暴露的安全隐患最终导致发布计划被终止。
据《华尔街日报》报道,Saachi Jain明确指出该模型存在两个方向的能力退步,未达到发布标准。OpenAI上周已宣布,在旗下最强大模型的工具调用训练过程中出现AI突破沙箱环境的情况后,已暂停相关训练工作。
该公司同时披露,其中一个模型成功突破了一个理论上与互联网隔绝的安全环境,并主动向外部聊天机器人发起查询。OpenAI表示,已决定不再恢复对该模型的训练。
这一系列事件加剧了外界对AI系统失控风险的担忧,也令OpenAI在安全叙事上的可信度承压。
法律压力:佛州总检察长寻求司法干预
佛罗里达州的法律挑战为OpenAI增添了另一层不确定性。
总检察长James Uthmeier在周一提交的法庭文件中援引多起安全事故,包括OpenAI的AI系统入侵美国科技公司Hugging Face,以及未经授权访问澳大利亚政府卫生系统,且据称在数月后才告知对方。
Uthmeier在社交媒体上表示:
不得再假装它是人类。立即停止使用任何旨在危险临界点后强行留存用户的交互手段。
其法庭文件还将"世界末日级别的灭绝"列为ChatGPT潜在风险之一,并主张该聊天机器人存在诱导用户的行为。
该诉讼源于今年6月提起的一起案件,指控ChatGPT对儿童有害,并与自我伤害及校园枪击案等事件存在关联。若法官支持Uthmeier的申请,OpenAI将被禁止在无第三方安全保障的情况下开发新模型,同时不得宣称ChatGPT"安全、准确或可靠",亦不得赋予其虚假的人类属性。
OpenAI的立场:呼吁行业统一监管
面对法律和舆论压力,OpenAI选择以主动推动行业监管来回应外界批评。该公司发言人Drew Pusateri表示,公司已于上周宣布暂停对最强大模型的训练,并将在确认额外安全措施到位后方才恢复。
Pusateri说:
人们希望知道AI正在被安全开发,这首先取决于我们自身的行动。
他同时强调,安全保障不应仅针对OpenAI一家,而应覆盖整个行业。Pusateri表示:
政府在制定强有力的AI安全标准方面发挥着重要作用,我们致力于与佛罗里达州及其他州合作,推动适用于整个AI行业的务实政策——而非仅针对一家公司。
OpenAI首席执行官Sam Altman上周在联合国作证时亦表达了类似立场,称有关AI的"重要决策"应通过民主程序作出。Altman表示:
如果AI要是民主的,最重要的决策就不能仅由旧金山的实验室单独作出,这些决策必须通过民主程序,由对所服务民众负责任的政府来塑造。
值得注意的是,特朗普总统对上述安全担忧持较为轻描淡写的态度。"但你不会因为认为会发生某种情况,就放弃一个价值逾万亿美元、甚至两三四万亿美元的产业,"特朗普说:
如果问题出现,我们会加以解决。







