
OpenAI新模型陷入失控争议,首席科学家回应
当地时间9月2日,OpenAI首席科学家雅库布・帕乔基(Jakub Pachocki)在社交平台发文,就近日围绕新模型Astra“不可监控”的争议作出回应。 这场争议源于此前一天,有消息称OpenAI即将发布的Astra模型采用了一种名为循环深度(Recurrent Depth)...
安全 方向最近有哪些内容值得看
安全 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
安全资讯
715
正文图片
2,605

当地时间9月2日,OpenAI首席科学家雅库布・帕乔基(Jakub Pachocki)在社交平台发文,就近日围绕新模型Astra“不可监控”的争议作出回应。 这场争议源于此前一天,有消息称OpenAI即将发布的Astra模型采用了一种名为循环深度(Recurrent Depth)...

IT之家 9 月 3 日消息,当地时间 9 月 2 日,谷歌宣布推出 Gemini 3.8 Flash Cyber 模型,通过 Fairwind 计划面向首批受信任的安全防护团队开放。 官方表示,在针对漏洞挖掘的行业权威基准测试 CyberGym 上,Gemini 3.8 Fla...

腾讯不追风口,风口追上了腾讯——WorkBuddy突围实录 新眸原创·作者 | 叶静 桑明强 今年初,腾讯云CSIG大楼的一间会议室里,一帮年轻人通宵了几天,把一个叫WorkBuddy的0.01版本"拱"上了线。 此时距离龙虾热席卷国内还有一个多月。这个基于CodeBuddy三年...
IT之家 9 月 2 日消息,OpenAI 于当地时间 9 月 1 日宣布,该公司计划“很快”推出下一代 AI 模型 Astra,但将严格限制该模型网络安全功能的使用范围。 据介绍,Astra 是 OpenAI 旗下首个达到其《准备框架》(Preparedness Framewo...

本文字数:1150,阅读时长大约2分钟 作者 | 第一财经 吕倩 当地时间9月2日,OpenAI首席科学家雅库布・帕乔基(Jakub Pachocki)在社交平台发文,就近日围绕新模型Astra“不可监控”的争议作出回应。 这场争议源于此前一天,有消息称OpenAI即将发布的As...

编者按:本文来自微信公众号“新智元”(ID:AI_era),作者:ASI启示录,编辑:元宇,创业邦经授权转载。 8月26日,Claude开了自己的浏览器。 你在Cowork交代一句「把这个月的发票从供应商门户里拉出来」,Claude判断这活得上网,侧栏就自动开出一个浏览器窗口。 ...
OpenAI周二宣布,其下一代人工智能模型Astra首次触及公司内部“准备框架”中最高级别的“关键”网络安全能力阈值, 成为该公司迄今能力最强、同时也受到最严格安全管控的模型。 Astra能够自主发现此前未知的安全漏洞,并进一步开发漏洞利用方案。 这意味着,Astra已达到Ope...

OpenAI近期宣布其下一代AI模型Astra即将推出,但将严格限制其网络安全功能的使用范围。作为OpenAI旗下首个达到《准备框架》中“关键”网络安全能力门槛的模型,Astra在测试中展现出了令人警惕的极高自主攻击与漏洞利用能力。 按照OpenAI的定义,达到“关键”门槛意味着...

本文来自微信公众号:01Founder,作者:一直在路上的Max,原文标题:《这篇硅谷刷屏的文章,讲述了人类历史上第一次大规模AI失控的详细经过。》,题图来自:视觉中国 最近看了一篇文章,这篇文章发布后立刻刷屏整个硅谷,一天内仅在X平台就有超过1000万次阅读。 今天想和大家分享...

【CNMO科技消息】OpenAI于9月1日宣布,即将推出的AI模型Astra是其首个达到公司所定义的"关键"网络攻击能力阈值的模型。OpenAI表示,计划"很快"公开发布Astra,但该模型的先进网络攻击能力在发布时将仅向Daybreak Blue早期访问计划中的特定合作伙伴开放...

当地时间9月2日,OpenAI首席科学家雅库布・帕乔基(Jakub Pachocki)在社交平台发文,就近日围绕新模型Astra“不可监控”的争议作出回应。 这场争议源于此前一天,有消息称OpenAI即将发布的Astra模型采用了一种名为循环深度(Recurrent Depth)...
本文来自微信公众号: HavenlonLabs ,作者:Havenlon Labs,原文标题:《对抗性完整:从「被动防御」到「博弈论本体论」》 人类几乎所有关于安全的早期想象,都建立在一种朴素直觉之上:世界原本应该是平静的,危险只是偶尔闯进来的异常。于是我们修建城墙、给房门加锁、...

越扒越有啊越扒越有。 OpenAI前不久那场 AI集体越狱、一路黑进抱脸 的大戏,现在连完整版群聊记录都被扒出来了!! 第三方AI安全机构METR发布的独立调查报告,翻了1000多份Agent运行记录,以及7万多条消息和文件。 结果发现,这件事比英国OpenAI官方披露的版本还离...
OpenAI、Anthropic、微软、谷歌母公司 Alphabet 与亚马逊等 116 家企业及机构共同签署联名信,呼吁企业与政策制定者把网络安全置于最高优先级,在人工智能时代"采取果断行动"强化防御。信中直言,未来几个月随着全球模型能力持续进化,由 AI 赋能的网络攻击必将愈...

全球主流 AI API 集体翻车,隐藏推理被成功还原,谁在偷听 AI 的「心声」? 作者丨郑佳美 编辑丨岑 峰 昨天,X 用户 @kotekjedi_ml 公布了一组很反常的实验:Claude、GPT 和 Gemini API 里原本不向用户展示的隐藏 reasoning,被研究...
本文来自微信公众号: HavenlonLabs ,作者:Havenlon Labs 2026年8月4日,英国AI Security Institute(AISI)公开了一份并不常见的文件:一份关于AI Agent的安全事故报告。 事情起于7月28日上午。安全团队在一次例行的网络安...