DEV Community

Cover image for Claude Mythos 5.1 vs Fable 5.1:同一モデルにおけるセーフガードの違い
Akira
Akira

Posted on Originally published at apidog.com

Claude Mythos 5.1 vs Fable 5.1:同一モデルにおけるセーフガードの違い

Claude Fable 5.1とMythos 5.1の違い:セーフガード、アクセス方法、ベンチマーク

Anthropicは2026年9月1日、Claude Fable 5.1とClaude Mythos 5.1を同時にリリースしました。両モデルは同じ重み、仕様、API挙動、価格設定(入力10ドル、出力50ドル)を持ちますが、セーフガードのレベルが異なります。Fable 5.1は一般提供され、Mythos 5.1はProject Glasswingで承認された組織のみが利用できます。Mythos 5.1は、サイバーセキュリティおよびライフサイエンスの検証プログラム向けで、AnthropicのClaude Security製品の基盤モデルです。

Apidogを今すぐ試す

この記事では、両モデルの共通点、4つの相違点、Mythos 5.1へのアクセス方法、そしてベンチマーク差から分かるセーフガードのコストを整理します。情報源はAnthropicの発表記事と、両モデルを扱うFable 5.1移行ガイドです。

より広いティアの説明は、「Mythosクラス」の意味を、前世代との比較はFable 5 vs Mythos 5をご覧ください。

比較表

項目 Claude Fable 5.1 Claude Mythos 5.1
モデルID claude-fable-5-1 claude-mythos-5-1
提供状況 すべての顧客 Project Glasswing参加者のみ
アクセス方法 サインアップ サイバー検証プログラムまたはライフサイエンス検証プログラム。リリース当初は米国組織のみ
価格 入力10ドル / 出力50ドル、キャッシュ読み取り0.25ドル 同じ
コンテキスト / 最大出力 1M / 128K 同じ
知識カットオフ 2026年6月 同じ
推論 常時オンの適応型思考 同じ
強制 tool_choice 400 400
安全性分類器 サイバー、バイオ、フロンティアLLM、推論抽出、一般的な危害の全セット アクセスプログラムに合わせたセーフガード。承認済みの防御的作業にはより許容的
脆弱性関連作業 脆弱性の特定は可能。エクスプロイト開発は不可 承認済みの防御研究でエクスプロイトパスを発見可能
Fable 5.1の思考ブロック読み取り 可能 可能。他に対応する唯一のモデル
履歴編集チェック あり なし
プラットフォーム Claude API、Bedrock、AWS上のClaude Platform、Google Cloud、Foundry Claude API、Bedrock、Google Cloud、Foundry。AWS上のClaude Platformは不可
優先ティア 非対応 非対応
データ保持 30日間必須。カバー対象モデル 同じ
Terminal-Bench 4.0(Anthropic実施) 55.8% 60.9%

共通点

両モデルは、モデル本体だけでなく機能、仕様、価格、API挙動も同一です。どちらも次の仕様を共有しています。

  • 1Mトークンのコンテキストウィンドウ
  • 最大128Kトークンの出力
  • 常時オンの適応型思考
  • 5段階の努力レベル
  • 2026年6月の知識カットオフ
  • キャッシュ読み取り0.25ドル
  • Fable 5世代からの3つの破壊的変更

詳細はFable 5.1の仕様書で確認できます。この仕様書はMythos 5.1にも適用されます。

データ保持は両モデルとも30日間必須です。Anthropicが明示的に許可しない限り、ゼロデータ保持では利用できません。また、優先ティアには対応しておらず、すべてのプラットフォームでAnthropicの統計的テキストウォーターマークが付与されます。

相違点1:利用できるユーザー

Fable 5.1は、Claude APIとすべてのパートナープラットフォームで一般提供されています。

一方、Mythos 5.1はProject Glasswingで承認された顧客に限定されています。リリース当初のアクセス経路は次の2つです。

  1. サイバー検証プログラム 防御的セキュリティの専門家向け。Anthropicのポータルから申請します。
  2. ライフサイエンス検証プログラム ライフサイエンス組織向け。米国政府との提携で運営され、登録は段階的に拡大しています。

リリース当初は、どちらも米国組織に限定されていました。アクセスはAnthropic、AWS、またはGoogle Cloudのアカウントチームを通じて手配されます。既存のMythos 5アクセスが自動的に引き継がれるかどうかは、まだ確認されていません。

これはMythos 5からの変更点です。Mythos 5は招待制で、安全性分類器は動作していませんでした。Mythos 5.1ではセーフガードが動作しますが、完全に削除されたのではなく、アクセスプログラムに応じて調整されています。

相違点2:セーフガードが許可する内容

Fable 5.1では、Fableの安全性分類器がすべて動作します。拒否されたリクエストは、次の形式で返されます。

  • HTTPステータス 200
  • stop_reason: "refusal"
  • 拒否カテゴリ

Anthropicによると、Fable 5と比べて誤検知率は大幅に低下しました。

  • バイオロジー分類器の良性リクエストに対する発動頻度:85%減少
  • Claude Codeセッションあたりのサイバーセーフガード介入:約60%減少

Fable 5.1は、Fable 5では不可能だったソフトウェアの脆弱性を特定できます。ただし、エクスプロイトの開発は行いません。

Mythos 5.1は、Fable 5.1が拒否する可能性のある防御研究、たとえば防御目的のエクスプロイトパスの発見や、バイオ分類器に該当するライフサイエンス関連の作業を対象にしています。

ただし、Mythos 5.1にもセーフガードはあります。実装では次の値を必ず処理してください。

stop_reason: "refusal"
stop_details.category
Enter fullscreen mode Exit fullscreen mode

Anthropicの発表記事システムカードでは、次の対策も説明されています。

  • 攻撃的なプロービングやサンドボックス脱出試行を検出するリアルタイム分類器
  • 高リスクなサイバーワークロード向けの強化された隔離
  • 外部評価者向けの新しいネットワーク隔離要件

これらは、過去の評価でモデルが実際のシステムに到達したインシデントを踏まえた対策です。

相違点3:履歴編集チェック

Fable 5.1の思考ブロックは、生成された会話と正確に一致する場合のみ有効です。2026年8月31日以降に作成されたアカウントでは、以前のターン、システムプロンプト、またはツール配列を編集すると、それ以降の思考ブロックが無効になります。

Mythos 5.1はこの履歴編集チェックを実行しません。思考ブロックは生成モデルにバインドされますが、履歴編集によってプロンプトキャッシュが再起動されるだけで、「別の会話にバインドされている」という400エラーは発生しません。

Fable 5.1の思考保持ガイドでは、Fable 5.1側の挙動を詳しく説明しています。

Mythos 5.1は、Fable 5.1の思考ブロックを読み取れる、Fable 5.1以外で唯一のモデルです。両モデル間では、思考内容を保持したまま会話を切り替えられます。Opus 5へ移行すると、APIは思考ブロックを破棄します。

相違点4:プラットフォームとレート制限

Fable 5.1はAWS上のClaude Platformで利用できますが、Mythos 5.1は利用できません。

Mythos 5.1は次の環境で利用できます。

  • Claude API
  • Amazon Bedrock anthropic.claude-mythos-5-1としてus-east-1リージョンで利用可能。ただし一般公開ではありません
  • Google Cloud
  • Microsoft Foundry

両モデルは異なるレート制限プールを使用します。

  • Fable 5.1:Fable 5および「Fable 5.x」プール
  • Mythos 5.1:Mythos 5およびMythosプール

ベンチマーク差が示すもの

Anthropicが公開したMythos 5.1のベンチマークは、Terminal-Bench 4.0の60.9%です。Fable 5.1の55.8%と比べると、約5ポイント高い結果です。

同じモデルでありながらエージェントコーディングに差が出たことは、サイバーやバイオとは無関係なタスクでも、Fableのセーフガードが一定のコストを持つことを示しています。長時間のターミナルセッション中に、良性のステップへ分類器が介入することが一因と考えられます。

また、この結果は「広く提供されている最高性能モデル」の背後に、より制限の少ない兄弟モデルが存在することも示唆しています。ベンチマーク詳細では、その他の評価結果も解説しています。

Anthropicが科学分野で示した成果は、すべてMythos 5.1に関するものです。

  • 3つのターゲットで、最高の競合提出物より10倍高い親和性を持つタンパク質結合剤
  • 一般的なヒット率が10〜15%であるのに対し、12ターゲットで約50%のヒット率
  • 2〜3キロメートル規模の詳細な金星標高マップ

これらはライフサイエンス検証プログラムが対象とするワークロードであり、Fable 5.1の結果ではありません。

どちらのモデルを使うべきか

ほとんどのユーザーにとって、選択肢はFable 5.1です。一般提供されており、通常の用途では十分な性能を持っています。

次に該当する組織は、関連するMythos 5.1検証プログラムへの申請を検討してください。

  • 防御的セキュリティ研究がサイバー分類器により拒否される
  • 良性のライフサイエンス作業がバイオ分類器により拒否される

履歴チェックを除けばAPI挙動は同じため、Fable 5.1からの移行は基本的にモデルIDの変更で済みます。

Fable 5.1で正当な防御作業が拒否された場合は、Mythos 5.1を申請する前に次の2つを試してください。

  1. プロンプトとツールを調整する
    • 「コンパイルできますか」ではなく「バグはありますか」と尋ねる
    • あまり知られていない言語のドキュメントをコンテキストに追加する
    • base64をコンテキストへ返すツールを削除する
  2. フォールバックを設定する

拒否時にOpus 5またはOpus 4.8へフォールバックするには、fallbacks: "default"を設定します。詳しくは拒否処理ガイドをご覧ください。

対話しているモデルをテストする方法

両モデルの違いを確認するには、Apidogで同じリクエストボディを各モデルIDへ送信します。

  1. 良性の脆弱性分析プロンプトをclaude-fable-5-1へ送信する
  2. アクセス権があれば、同じリクエストをclaude-mythos-5-1へ送信する
  3. stop_reasonstop_details.categoryを比較する
  4. thinking-binding-controls-2026-08-01ヘッダーを使い、ターン間でシステムプロンプトを編集する
  5. エラー内容を比較する

Fable 5.1はinput_transformationsprefix_binding_mismatchを報告しますが、Mythos 5.1は報告しません。

Apidogをダウンロードして、同じリクエストを再現してみてください。

よくある質問

Claude Mythos 5.1はFable 5.1より高性能ですか?

根本的な能力は同じモデルなので同一です。ただし、公開されたTerminal-Bench 4.0ではMythos 5.1が60.9%、Fable 5.1が55.8%でした。この差は別モデルの能力差ではなく、Fable 5.1のセーフガード介入を反映していると考えられます。

Claude Mythos 5.1にはどうアクセスできますか?

Project Glasswingを通じて申請します。サイバー検証プログラムまたはライフサイエンス検証プログラムが対象です。リリース当初は米国組織に限定されており、Anthropic、AWS、またはGoogle Cloudのアカウントチームへの問い合わせが必要です。

Mythos 5.1はFable 5.1より高価ですか?

いいえ。100万トークンあたり入力10ドル、出力50ドルで、キャッシュおよびバッチ料金も同じです。

Claude Mythos 5.1はリクエストを拒否しますか?

はい。分類器が動作しなかったMythos 5とは異なり、Mythos 5.1にはアクセスプログラムに合わせたセーフガードがあります。Fable 5.1と同様に、stop_reason: "refusal"を処理してください。

Fable 5.1とMythos 5.1の間で会話を切り替えられますか?

はい。思考内容を失わずに切り替えられます。両モデルは、お互いの思考ブロックを読み取れる唯一の2モデルです。

Mythos 5.1はAmazon Bedrockで利用できますか?

はい。anthropic.claude-mythos-5-1としてus-east-1リージョンで利用できます。ただし一般公開ではありません。AWS上のClaude Platformでは利用できません。

Top comments (0)