Anthropic、1つのモデルに2つの安全レベルを設けた「Claude Fable 5.1」と「Mythos 5.1」を公開
Anthropicは2026年9月1日、Claude Fable 5.1とClaude Mythos 5.1を公開しました。同社によると、両者の土台は同じモデルで、セーフガードだけが異なります。セーフガードとは、AIが何を手伝うかを制限するルールやフィルターのことです。
Fable 5.1は一般提供されており、AnthropicのAPI(開発者がアプリを作るときに使う接続口)やクラウドプラットフォームからも利用できます。一方、Mythos 5.1は特別なアクセスプログラムを通じて、審査を経たサイバーセキュリティや生命科学の専門家だけに提供されます。Anthropicによると、一般的な作業ではFable 5.1のコストがFable 5より約25%低くなる見込みです。また、モデルがすでに処理したテキストを再利用する「キャッシュ読み取り」の料金を75%引き下げました。
今回のアップデートでは、誤った警告を減らすことも目指しています。Anthropicの報告によると、サイバー関連のセーフガードが介入する頻度はセッションあたり約60%減り、生物学関連のセーフガードが無害な基本的な質問で作動する頻度は85%減りました。TechCrunchは、モデルと同時に公開された安全性報告書「システムカード」に、望ましくない動作を総合的に測る指標でMythos 5.1が以前のバージョンよりわずかに悪い結果だったと書かれていることを指摘しました。
なぜ重要なのか:AI企業は、危険な依頼を防ぐことと、ごく普通の質問をする人を困らせないことのバランスを取らなければなりません。今回のリリースは、その兼ね合いが実際にどう行われているかを示しています。
出典:Anthropic — https://www.anthropic.com/claude-fable-and-mythos-5-1
出典:TechCrunch — https://techcrunch.com/2026/09/01/anthropics-new-fable-release-is-cheaper-less-restrictive/
コメント 0
まだコメントがありません。最初のコメントを書いてみましょう。