品玩6月12日讯,据 fastcompany 报道,Anthropic近日发布了其最强公开模型Claude Fable 5,但上线仅两天便引发用户关于安全系统过度拦截的投诉。
由于该模型源自具备强大漏洞利用能力的Mythos系列,Anthropic出于防范风险考虑,将网络安全、生物学和化学列为高风险领域。当提示词触发敏感标签时,系统会自动将其路由至能力较弱的Claude Opus 4.8处理。
尽管官方称此类降级仅影响约0.05%的查询且会通知用户,但实际误报率远超预期。大量开发者反映,诸如绵羊RNA测序数据编辑、简历修改甚至购物清单等常规请求均被拒绝。科学家Derya Unutmazon与创始人Bojan Tunguz均在X平台上对此表达了不满。
针对这一现象,Anthropic回应称,隐蔽的安全防护机制虽能更精准地防御攻击,但显性的安全措施必须覆盖更广的范围以确保稳健性,这不可避免地导致了更多合法请求被错误标记。公司表示目前正着手解决该问题。








