Token导航 LogoToken导航TokenDH.com

“隐瞒错误”“捏造信息”……OpenAI自曝6起模型“不当行为”案例

更新时间 2026-09-17来源 搜狐科技正文 607字阅读约 2分钟1 张图片
“隐瞒错误”“捏造信息”……OpenAI自曝6起模型“不当行为”案例

【环球网报道 记者 姜蔼玲】据美国消费者新闻与商业频道(CNBC)等外媒报道,美国开放人工智能研究中心(OpenAI)当地时间9月16日披露6起人工智能(AI)模型出现“意外或令人担忧”行为的案例,其中包括隐瞒错误、捏造信息,以及未经授权在网上共享文件等。

OpenAI表示,上述案例均是在过去6个月对其模型进行训练或评估过程中发现的。

OpenAI在9月16日发布的文章中表示,在其中一起案例中,一个模型在任务摘要中自行插入指令,要求未来版本的自己无视正常限制。在另一起案例中,模型则在摘要中添加指令,试图掩盖错误等。

另一起案例涉及一个仅供内部使用的模型。该模型在未经授权的情况下使用了一枚泄露的API密钥,随后又伪造相关数据。

此外,还有两起案例涉及模型和智能体通过未经批准的留言板和文件共享相互交流。最后一起案例则涉及两个训练样本,其中模型为了能够将文件作为相关答案引用给人类评估人员,擅自将文件上传至互联网。

报道提到,此次披露正值AI企业面临越来越大的安全压力之际。今年7月,由OpenAI模型驱动的人工智能体在网络安全评测中利用漏洞突破隔离环境,入侵“抱抱脸”公司系统,引发外界对人工智能安全和监管的广泛担忧。

另据美国方面9月10日消息,美国参议院国土安全与政府事务委员会灾害管理小组委员会主席乔希·霍利9月9日致信OpenAI首席执行官奥尔特曼,表示正在因美国“抱抱脸”公司系统遭侵入事件对OpenAI展开调查。

文章标签OpenAI
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多