Anthropic发布Claude Fable 5.1和Mythos 5.1:同一模型,两种安全级别
2026年9月1日,Anthropic发布了Claude Fable 5.1和Claude Mythos 5.1。公司表示,两者底层是同一个模型,只是配备了不同的安全防护措施(safeguards),也就是限制AI可以协助做哪些事情的规则和过滤机制。
Fable 5.1已全面开放使用,包括通过Anthropic的API(开发者构建应用时使用的连接接口)和云平台。Mythos 5.1则通过特别访问计划,仅向经过审核的网络安全和生命科学领域专业人士提供。Anthropic表示,在典型工作中,Fable 5.1的费用应比Fable 5低约25%;公司还把缓存读取的价格下调了75%。缓存读取是指模型重复使用已经处理过的文本。
这次更新还力求减少误报。Anthropic称,其网络安全防护措施在每次会话中的介入频率降低了约60%,生物学防护措施在无害的基础问题上被触发的频率降低了85%。TechCrunch指出,随模型发布的安全报告“系统卡”(system card)显示,在一项衡量不良行为的总体指标上,Mythos 5.1的表现比早期版本略差。
为什么重要:AI公司必须在拦截危险请求和避免让提出普通问题的人感到困扰之间取得平衡,这次发布正体现了这种权衡。
来源:Anthropic — https://www.anthropic.com/claude-fable-and-mythos-5-1
来源:TechCrunch — https://techcrunch.com/2026/09/01/anthropics-new-fable-release-is-cheaper-less-restrictive/
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨보세요.