6月12日消息,据fast company报道,anthropic近期推出了其目前公开可用的最强模型——claude fable 5。然而该模型上线仅48小时,便因安全策略过于严苛而招致大量用户投诉。
该模型基于具备突出漏洞利用能力的Mythos系列构建,因此Anthropic在部署时将网络安全、生物学及化学三大领域列为高风险类别。一旦输入内容被系统识别为触发相关敏感标签,请求便会自动转交至性能较低的Claude Opus 4.8进行响应。
官方声明指出,此类降级处理仅涉及约0.05%的查询,并承诺会在发生时向用户明确提示。但实际运行中误判率显著偏高。多位开发者反馈,包括“绵羊RNA测序数据整理”、“简历润色”乃至“日常购物清单生成”等常规任务均遭无差别拦截。科学家Derya Unutmazon与创始人Bojan Tunguz均在X平台公开表达了质疑与不满。
对此,Anthropic解释称:隐式安全机制虽可提升攻击识别精度,但显性防护层需兼顾更广泛的潜在威胁面,以保障整体系统鲁棒性——这一设计取舍客观上导致了更多合规请求被错误归类。公司确认已启动专项优化工作,正积极修复相关问题。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜












