
当EXO多出第13人,一场AI制造的集体幻觉
本文来自微信公众号: 文娱先声 ,作者:先声编辑部 “你认识King吗?” 在直播间,黄子韬一脸疑惑地问旁边工作人员,这条弹幕“是什么意思?King是一个网络用语吗?”他或许并未意识到,自己已经被卷入一场由AIGC技术引发的大型社会试验。 最近,一个名为“EXO幽灵成员King”...
安全 方向最近有哪些内容值得看
安全 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
安全资讯
748
正文图片
2,674

本文来自微信公众号: 文娱先声 ,作者:先声编辑部 “你认识King吗?” 在直播间,黄子韬一脸疑惑地问旁边工作人员,这条弹幕“是什么意思?King是一个网络用语吗?”他或许并未意识到,自己已经被卷入一场由AIGC技术引发的大型社会试验。 最近,一个名为“EXO幽灵成员King”...

发布新旗舰模型Claude Opus 4.6后不到两周,OpenAI的劲敌Anthropic再次推出重磅产品Claude Sonnet 4.6,以中端的价格提供接近旗舰级模型的智能水平。这对AI行业构成了一次重大的定价格局重塑。 美东时间2月17日周三,Anthropic官宣发布...

近日,华尔街日报报道,安全专家通过使用 Anthropic 公司的最强 AI 模型 Claude Mythos,成功发现了苹果 macOS 26.4.1 系统中的一个提权漏洞。这项技术创新为信息安全领域带来了新的启示,尤其是在操作系统安全防护方面。 来自安全公司 Calif 的研...
在网络安全日益重要的今天,微软自主代码安全团队于 5 月 13 日推出了一款名为 MDASH 的多模型智能体扫描框架。这一新系统的设计理念颠覆了传统的单一 AI 模型,采用了多智能体协作策略,以提升代码安全检测的准确性和效率。 MDASH 框架整合了超过 100 个基于不同前沿大...
在人工智能技术飞速发展的今天,微软又一次向我们展示了它的创新力量。5 月 13 日,微软自主代码安全团队正式发布了名为 MDASH 的多模型智能体扫描框架。这一全新的安全系统不仅在技术上走在前列,更在实际应用中展现了惊人的漏洞识别能力,尤其是在与知名的 GPT-5.5 和 Ant...

腾讯前沿科技论文解读专栏,在代码与商业的交汇处,寻找AI的确定性。 文|博阳 编辑|徐青阳 Anthropic 5月8 日发布了一篇对齐研究《Teaching Claude Why》,讨论的人不多。 我觉得它其实很有启发性。 过去大模型的对齐似乎非常低效。做了一通RLHF,模型依...

作者 | 黄昱 随着AI模型渗透率的提高,一些说多了的“谎话”成了事实,并成为AI对现实的潜在威胁。 日前央视3·15将“给AI投毒”推上热搜。通过一款名为"力擎GEO(生成式引擎优化)优化系统"的软件,只需虚构一款产品并批量发布虚假软文,主流AI在推荐时就会将其列为“高性价比”...

本文来自微信公众号: Fast Company中文版 ,作者:Mos Wu、Eric Xie 在这个被算法接管的时代,最致命的危机并非机器正在长出“大脑”,而是人类正在主动交出大脑。 今年3月,前皇家马德里营养师Itziar González在社交媒体上公开爆料:皇马医疗团队的工...
OpenAI 于 5 月 14 日针对近期发生的“Mini Shai-Hulud”供应链攻击事件发布正式声明。安全团队在监测到针对热门开源库 TanStack 及多款常用 npm 软件包的恶意攻击后,已完成内部系统排查,结果显示目前 未发现任何用户数据被泄露或非法访问的证据 。 ...

一家估值接近万亿的超级AI巨头,正在美国加州的法庭上被彻底“扒下底裤”。 马斯克起诉OpenAI CEO萨姆·奥特曼(Sam Altman)的世纪审判进入第二周,这场原本关乎“人类命运与AI安全”的严肃商业诉讼,画风已经彻底跑偏,演变成了一场高管“互撕”与人身攻击。 法官直言不讳...
谷歌安全研究人员发现,一个网络犯罪组织借助人工智能生成了一款黑客工具,成功找到一款广泛使用的系统管理软件中的未知漏洞,并企图将其武器化。 这是谷歌首次捕获到利用AI生成"零日漏洞"的攻击行为,标志着AI驱动的网络攻击已从理论威胁演变为现实。零日漏洞是指开发者未知的缺陷,防御者在漏...
5 月 12 日消息,谷歌旗下威胁情报团队(GTIG)表示,基于目前披露的线索和证据,首次识别出一起“由 AI 参与开发”的零日利用事件。 谷歌本轮发现该事件攻击瞄准一款未具名的开源 Web 管理工具,目标是绕过双因素认证(2FA),但在大规模利用前被拦截。GTIG 认为,这已显...

新智元报道 编辑:Aeneas KingHZ 【新智元导读】 就在刚刚, Claude Mythos 把评测干「失效」了:METR第一次测不准,AI攻防拐点到了!AI进化已成「外星文明」降临,超越指数增长,2027 AGI 奇点正加速撞向人类。 刚刚,Claude Mythos干...

品玩5月12日讯,据 eWeek 报道,OpenAI正式宣布,面向欧洲地区的部分用户开放网络安全专用模型GPT-5.5-Cyber。 该模型基于GPT-5.5架构开发,专为由OpenAI验证的网络安全防御人员设计,支持漏洞识别、恶意软件分析、红队测试及补丁验证等关键任务。此举正值...

梦晨 发自 凹非寺 量子位 | 公众号 QbitAI ChatGPT默认模型,今天大升级。 新版本 GPT-5.5 Instant , 结合了5.5的基础智力 + 极速回复。 免费用户也能用 。 最关键的四点: 幻觉减少了52.5%。 新增“记忆来源”,展示过去的哪条对话影响了本...

IT之家 5 月 11 日消息,法国企业 Thales 披露,目前网络机器人已占据互联网流量主导地位,占全网总流量的一半以上,其中 40% 属于恶意机器人。Thales 在一份报告中指出,2025 年由人工智能驱动的机器人攻击数量较上一年激增 12.5 倍。 IT之家注意到,这份...

感谢IT之家网友 华南吴彦祖 的线索投递! IT之家 5 月 12 日消息,谷歌旗下威胁情报团队(GTIG)表示,基于目前披露的线索和证据, 首次识别出一起“由 AI 参与开发”的零日利用事件。 谷歌本轮发现该事件攻击瞄准一款未具名的开源 Web 管理工具,目标是绕过双因素认证(...

IT之家 5 月 12 日消息,路透社查阅美国商务部官网发现,该部门已从其网站上移除了与谷歌、xAI 及微软达成的、用于测试其人工智能模型安全漏洞的协议相关细节。 此前指向美国商务部此次测试相关公告的链接现已失效。截至华盛顿当地时间周一下午,点开该链接会显示“抱歉,未找到该页面”...

OpenClaw 的爆火,让一个原本更多停留在技术圈内部的变化,突然变得具象起来。 当一个 Agent 可以跨应用执行任务、调用工具、在几乎没有人工干预的情况下完成复杂流程时,人们第一次直观地看到:AI 正在从“生成内容的工具”,转变为“参与行动的主体”。也正是在这一刻,安全问题...

ITCOW牛新网 5月6日消息,OpenAI 于今日凌晨宣布对 ChatGPT 进行更新,将其默认模型升级为 GPT-5.5 Instant 。此次升级核心聚焦于提升事实准确性与回复简洁性,并针对用户反馈的“过度使用表情符号”问题进行了专项优化。 准确性大幅跃升,高风险领域“幻觉...