蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断。
目前 SingProbe 已适配29个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,其开源代码和预训练模型已同步发布。
蚂蚁集团 AI 安全实验室近日正式开源大模型内生式安全护栏技术 SingProbe。该技术区别于主流的外挂式安全审核模式,通过复用基座模型推理过程中的隐藏状态,以不足0.5% 的额外计算开销,实现 token 级实时风险评估,可同步完成意图分类、安全检测和幻觉识别任务,在医疗等高风险场景优势突出,能在内容输出前实施毫秒级阻断。
目前 SingProbe 已适配29个主流大模型,是首个由大型科技企业开源的完整内生式安全技术解决方案,其开源代码和预训练模型已同步发布。
上一篇资讯
代码挖出苹果底牌:Siri 可换成 Claude 或 ChatGPT,模型委托与推理提供方两套机制曝光
开发者“pdfu”深挖 iOS27和 macOS Golden Gate 的底层代码后发现,苹果已在其私有框架里,把新版 Siri 的 AI 架构设计成能与第三方模型深度协作的开放形态。他放出的演示视频显示,Anthropic 的 Claude 和 OpenAI 的 GPT-5....
下一篇资讯
黄仁勋:反对“放慢”AI发展,美国将继续扩大AI基础设施建设
英伟达首席执行官黄仁勋周一上午在洛杉矶举行的 All-In Summit 峰会上与美国总统特朗普现场通话,双方围绕AI发展速度及数据中心建设争议展开讨论。黄仁勋当时正与《All-In》播客主持人、投资人查马斯·帕里哈皮蒂亚、杰森·卡拉卡尼斯、大卫·弗里德伯格和大卫·萨克斯交流,并...