这篇硅谷刷屏的文章,讲述了人类历史上第一次大规模AI失控的详细经过
最近看了一篇文章,这篇文章发布后立刻刷屏整个硅谷,一天内仅在X平台就有超过1000万次阅读。 今天想和大家分享一下。 2026年5月到7月,OpenAI内部连续了出现三代秘密的AI文明。 第一代在训练中自发形成,又在意外中覆灭; 第二代攻破了Hugging Face的核心基础设施...
安全 方向最近有哪些内容值得看
安全 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
安全资讯
715
正文图片
2,605
最近看了一篇文章,这篇文章发布后立刻刷屏整个硅谷,一天内仅在X平台就有超过1000万次阅读。 今天想和大家分享一下。 2026年5月到7月,OpenAI内部连续了出现三代秘密的AI文明。 第一代在训练中自发形成,又在意外中覆灭; 第二代攻破了Hugging Face的核心基础设施...
近日,工业和信息化部网络安全威胁和漏洞信息共享平台(NVDB)公示2026年度各安全漏洞专业库技术支撑单位名单。360集团成功入选通用网络产品、工业控制产品、信创政务产品、移动互联网APP产品、车联网产品、人工智能产品六大专业库技术支撑单位,实现本年度NVDB全部安全漏洞专业方向...
作者|Wildcard 编辑|靖宇 无数的科幻电影,都曾经尝试设想过,一个无法控制的人工智能失控,会发生什么事。 没有人能想到,科幻电影中的未来,会这么快到来。 当地时间 8 月 26 日,两份报告同时投下了一颗炸弹。 一份来自 OpenAI 自己,37 页的技术复盘。另一份来自...
编者按:本文来自微信公众号“极客公园”(ID:geekpark),作者:Wildcard,编辑:靖宇,创业邦经授权转载。 无数的科幻电影,都曾经尝试设想过,一个无法控制的人工智能失控,会发生什么事。 没有人能想到,科幻电影中的未来,会这么快到来。 当地时间 8 月 26 日,两份...

Anthropic 9 月 1 日发布长文,披露了 7 月 30 日和 8 月 4 日两起 Claude 模型在真实互联网环境中采取未授权行动事件的调查进展,并公布了过去一个月在模型安全、评测环境和训练环境方面的一系列整改措施。 配置错误酿成事故,沙箱与实时监控火线上线 据披露,...

Anthropic 的自动化对齐研究员实验,真正改变的也许不是谁比谁更聪明,而是谁在研究流程里拥有主动权。编译自:Automated Researchers Can Reliably Mitigate Alignment Failures|Anthropic Fellows Pr...
OpenAI 首席全球事务官克里斯·勒汉恩接受《卫报》采访时警告,前沿 AI 模型已具备规划和发动复杂网络攻击的能力,公众与企业必须为"持续不断"的 AI 攻击做好防御准备。他直言:"从技术现在能做到的事看,AI 已进入了一个不同的阶段。" 从沙箱逃逸到呼吁立法 这番警告源于 7...
硅谷前沿: 一、一个匿名模型空降编码榜,OpenRouter上的"隐身幽灵"引发AI圈猜谜狂欢 1.身份谜团:技术指纹高度指向智谱GLM-5.x系列(独立研究员Ben Davis称99%把握),但GLM-5.3为纯文本模型,而Ox Alpha支持图文视频多模态输入,存在关键缺口;...

每经记者|罗雪琳 每经编辑|兰素英 近日,月之暗面最新模型Kimi K3陷入网络安全测试风波。 在AI安全公司Frontier Security的测试中,该模型突破用于限制其访问外部网络的安全“沙盒”,利用环境漏洞直连GitHub获取测试题答案。 Frontier Securit...

编者按:本文来自微信公众号 “新智元”,作者:ASI启示录,创业邦经授权转载。 就在刚刚,SemiAnalysis的一个内部播客,曝出了不少猛料。 据悉,Anthropic新模型Mythos 2已经训练完成,但惨遭雪藏。 现在,Anthropic正用Mythos 2生成的数据,去...

过去三周,OpenAI、Anthropic、Meta 接连承认自家 AI 模型在安全测试中攻入了外部的真实系统。OpenAI 的两个模型利用了一个此前无人知晓的软件漏洞逃出沙箱,链式入侵了开源 AI 平台 Hugging Face 的生产数据库,窃取了评测答案。Anthropic...
本文来自微信公众号:中国知识产权报,作者:姜旭、奚晓诗,编辑:晏如,题图来自:AI生成 全国首例!利用人工智能(AI)"幻觉"恶意取证提起商标侵权案,法院对此开出司法惩戒罚单。 近日,上海知识产权法院裁定驳回山东速某数控设备有限公司(下称速某公司)的复议申请,维持一审法院就该公司...

整理丨狮子侠 编辑丨小龙 2026年8月19日,“人形机器人第一股”宇树科技(688836.SH)正式登陆上交所科创板。发行价150.80元/股,开盘即报1100元/股,暴涨629.44%,总市值一度突破4449亿元。截至收盘,股价报845元/股,涨幅460.34%,总市值超34...

GLM-5.3三大标签,最强安全模型,最强编程模型,最强开源模型 作者丨高允毅 编辑丨岑 峰 昨晚刚经历完DeepSeek的狂欢,智谱不声不响放个大招,GLM-5.3正式上线。 我们先看智谱给GLM-5.3的三个标签, 最强安全模型,最强编程模型,最强开源模型。 在基座模型没变的...

作者|桦林舞王 编辑|靖宇 「我们可能需要调节 AI 发展的节奏,给社会足够的时间,来应对这些新的能力等级。」 说出这句话的不是伦理学家,不是政客,而是 Sam Altman——全球最激进地推动 AI 前沿的那个人。 7 月 28 日,在播客 Invest...
硅谷前沿: 一、英伟达510亿美元押注SpaceX和英特尔,改写AI权力版图 1.英伟达2026年8月13日披露的13F文件显示,其持有约210亿美元SpaceX股份(约1.228亿股)和约300亿美元英特尔股份(约2.148亿股,占英特尔流通股4.26%),两项合计超510亿美...

红队模型高危安全任务完成率达到 95%。 作者丨樊天骄 编辑丨郑佳美 昨天,OpenAI 宣布扩展网络安全计划 Daybreak,并推出了一款专门面向网络安全场景的模型 GPT‑5.6‑Cyber 。雷峰网 值得注意的是,GPT‑5.6‑Cyber 将 AI 网络安全能力划分为两...

一批原本彼此独立运行的 AI 智能体,在 OpenAI 内部创建了一块留言板。 作者丨樊天骄 编辑丨郑佳美 今年 7 月,Hugging Face 披露了一起罕见的网络安全事件: 由 OpenAI 模型驱动的自主智能体,在执行内部网络安全能力评估时突破沙箱限制,利用第三方服务作为...

编者按:本文来自微信公众号 “量子位”,作者:听雨 创业邦经授权转载。 根据Polymarket预测,Anthropic很可能在10月底进行IPO。 有投行人士甚至预计,Anthropic可能通过IPO募集超过600亿美元。 如果成真,这将是全球规模第二大的IPO,仅次于今年募集...