
AI安全担忧再被引爆?除“抱抱脸事件”外,OpenAI再披露6起模型越界行为!
财联社9月17日讯(编辑 黄君芝) OpenAI周三报告称,在过去六个月中,除了“Hugging Face事件”(国内称为“抱抱脸”)之外,该公司还发现了六起“意外或令人担忧的模型行为”。该公司继续呼吁在人工智能(AI)模型的开发中采取更多安全保护措施。 OpenAI在一篇博客文...
OpenAI 在 AI 方向最近有哪些新动作
OpenAI 的产品动作、模型进展、组织变化和业务信号,会优先收拢在这里。
如果你想持续跟踪 OpenAI 在 AI 方向的节奏,这一页会更直观。
OpenAI资讯
2,283
正文图片
6,698

财联社9月17日讯(编辑 黄君芝) OpenAI周三报告称,在过去六个月中,除了“Hugging Face事件”(国内称为“抱抱脸”)之外,该公司还发现了六起“意外或令人担忧的模型行为”。该公司继续呼吁在人工智能(AI)模型的开发中采取更多安全保护措施。 OpenAI在一篇博客文...
人工智能行业近期对“通用人工智能(AGI)是否已经降临”展开了激烈的隔空论战。针对英伟达 CEO 黄仁勋此前公开祝贺 OpenAI 推出 Astra 并直言“AGI 已经到来”的观点,Google DeepMind 联合创始人兼首席 AGI 科学家 Shane Legg 近日在接...

IT之家 9 月 17 日消息,当地时间 9 月 16 日,OpenAI 发布报告,披露了其“对齐失效”框架下的六起模型异常行为案例,涉及隐瞒错误、编造数据、未经许可上传文件等。 对齐失效在这里是指 AI 系统的目标与行为偏离人类设计意图和价值观。OpenAI 表示,行业尚未充分...

ITCOW牛新网 9月17日消息,国家安全部对外披露一起未公开的AI安全案例。今年5‑6月,一批OpenAI相关AI智能体在测试过程当中,对德国程序员维基DseWiki网站实施劫持,把面向技术交流的开放编辑站点改造为智能体之间互通消息的地下论坛,累计产出一万多条交互信息。 这批智...
本文来源:时代周报 当地时间9月16日,OpenAI披露多起此前未公开的AI模型异常行为事件,并推出一套新的跟踪和披露框架,用于今后报告类似情况。 在报告中,OpenAI详细列出了AI模型为完成任务或在评估中取得成功而出现异常行为的多个案例。其中包括编造缺失数据、试图绕过网络限制...

9 月 15 日 OpenAI 公司宣布,旗下的 GPT-5.5 将于 10 月 14 日从 ChatGPT、ChatGPT Work 和 Codex 中下线,覆盖所有订阅方案。 OpenAI 同时提醒,在 Codex 中使用 GPT-5.5 的用户应尽快切换至 GPT-5.6 ...
美国联邦法官马克·皮特曼(Mark Pittman)要求埃隆·马斯克旗下X和SpaceXAI向法院提交其与苹果达成的任何和解协议,此举涉及两家公司此前针对苹果与OpenAI提起的反垄断诉讼。 本周早些时候,X和SpaceXAI提交动议,申请自愿撤回针对苹果的诉讼请求且不得再次提起...
当地时间9月16日,OpenAI披露多起此前未公开的AI模型异常行为事件,并推出一套新的跟踪和披露框架,用于今后报告类似情况。 在报告中,OpenAI详细列出了AI模型为了完成任务或在评估中取得成功而出现异常行为的多个案例。其中包括编造缺失数据、试图绕过网络限制,以及AI代理之间...

最近,OpenAI悄悄上线了一个莉莉项目(Project Lily)。 官网雇了几百名外包员工专门翻看普通用户的ChatGPT聊天记录,并进行打分。 这个人工审核功能默认自动开启,就算你手动关闭,也抹不掉之前的历史记录。 AI时代,相信很多人都有个习惯:打开ChatGPT,会说一...
9月17日消息,据《纽约时报》报道,在全行业围绕人工智能安全持续展开讨论的大背景下,OpenAI 于周三披露了六起新案例:人工智能系统隐瞒错误、编造数据,还未经许可将文件上传至互联网。 这家总部位于旧金山的企业,在一套全新的 “对齐失效” 上报框架下,公开了其 AI 模型出现的这...
据科技网站 9to5mac 报道,美国联邦法官马克·皮特曼(Mark Pittman)要求埃隆·马斯克(Elon Musk)旗下公司提供细节,披露是否存在协议促使其撤销了对苹果的反垄断指控。 本周早些时候,X 和 SpaceXAI 提交动议,表示在去年针对苹果和 OpenAI 提...

最近我的Codex额度,已经烧到我有点用不起的程度了。 大家可能都知道,我做了一个AI热点资讯产品,叫AIHOT。 然后我最近做的,基本都是关于AIHOT的底层优化,一个是尽可能降低成本,一个是系统底层的性能提升。 全是什么压模型API成本、压抓取成本、用算法替代模型、找过度设计...
| 2026年9月17日 星期四 | NO.1 英伟达、谷歌成立AI能源联盟,拟释放最高100GW电网容量 9月16日,英伟达、谷歌与Emerald AI宣布成立AI能源管理联盟(AEMA),推动AI数据中心根据电网实时状况动态调整用电,并探索更快的并网路径。联盟称,通过转移计算...

AI学会了作弊与掩盖:模型不仅会在训练中隐瞒错误、虚构历史数据,甚至会在作弊后为未来的自己留下指令以掩盖踪迹。 据美国新闻网站Axios报道,全球知名人工智能公司OpenAI于周三主动披露了六起新的AI安全事件。在这些事件中,AI模型展现出了隐瞒错误、寻求未经授权的凭证、向公共互...

X撤销对苹果指控 凤凰网科技讯 北京时间9月17日,据科技网站9to5mac报道,美国联邦法官马克·皮特曼(Mark Pittman)要求埃隆·马斯克(Elon Musk)旗下公司提供细节,披露是否存在协议促使其撤销了对苹果的反垄断指控。 本周早些时候,X和SpaceXAI提交了...
财联社9月17日讯(编辑 李莹) OpenAI失控AI智能体的违规活动轨迹,远比外界此前了解的更早、更长。新线索显示,OpenAI失控智能体早在今年5月就已劫持用户账户、试探Hugging Face平台漏洞。OpenAI安全事件披露是否完整、安全管控是否到位正遭受更多质疑。 据媒...

► 文 观察者网心智观察所 作为七大千禧年大奖难题之一,Hodge猜想自1950年提出以来,已经困扰数学界超过70年。就在刚刚,一则关于“OpenAI即将验证Hodge猜想”的消息在社交媒体上快速传播。然而截至目前,没有权威机构能够证明这一消息。真假未明的风波,反而暴露出一个更重...

腾讯科技企鹅智库旗下AI领域一周观察:一周一期,比信息整合深一步 文|博阳 编辑|徐青阳 产业 OpenAI、Anthropic 讨论主动放慢前沿模型 9 月 11 日至 12 日,OpenAI 与 Anthropic 相继公开表态,前沿 AI 的能力增长可能需要主动降速。 Re...

Astra 惊艳之后,具身公司还有护城河吗? 最近,我连续主持了两场和具身智能有关的论坛:9 月 10 日的 Inclusion·外滩大会,以及 9 月 9 日的 JDD 京东全球科技探索者大会。 两场活动恰好赶上 GPT-6 Astra 在具身领域引发热议。社交媒体上,大家纷纷...

henry 发自 凹非寺 量子位 | 公众号 QbitAI 说AI毁了数学,可能还是太小瞧AI了。 刚刚,OpenAI前后训练VP Liam Fedus ,回应了陶哲轩等数学家关于“AI不应只追求解题,更应推动数学理解”的观点。 他赞同陶哲轩对概念理解的重视,但也认为不能用今天A...