Claude Fable 5.1とClaude Mythos 5.1の違い
Claude Fable 5.1とClaude Mythos 5.1は同じモデルですが、セキュリティ対策レベルが異なります。
Fable 5.1は一般公開されていますが、Mythos 5.1はアンソロピック社が承認したアクセスプログラムでのみ利用可能です。
性能
Claude Fable 5.1は、コーディング、知識労働、および長時間にわたる問題解決タスクにおいて、前バージョンのFable 5よりもはるかに高いパフォーマンスを発揮します。





■ Terminal-Bench(ターミナルベンチ)
スタンフォード大学とLaude Instituteの研究チームが作成したベンチマークです。主にAIエージェントによるコード実行やターミナル操作、科学的タスクの処理能力を評価します。
■ OSWorld(オーエスワールド)
香港大学のXLANG Labの研究チームが作成したベンチマークです。OS上の操作やPC画面を用いたコンピューター利用能力(Computer Use)を評価します。
■ AutomationBench(オートメーションベンチ)
iPaaS(業務自動化プラットフォーム)を提供するZapierが作成したベンチマークです。実際のビジネスワークフローや自動化タスクにおけるAIモデルの遂行能力を評価します。
■ CursorBench(カーソルベンチ)
AIコードエディタCursorを開発するAnysphereが作成したベンチマークです。実際のコーディング環境や開発ツール内でのコード補完・編集・エージェント機能を評価します。
価格
キャッシュ読み取り料金の引き下げにより、Anthropicは一般的な処理で約25%、エージェントを多用する処理では最大約45%の費用削減を見込んでいます。入力・出力の基本単価が一律25%下がったという意味ではなく、実際の削減幅はキャッシュの利用量などに左右されます。

データ保持
新しいエンタープライズ・フロンティア・セーフガード(EFS)システムが導入されます。
Anthropic側ではなく、顧客が管理するクラウド基盤にデータを保管する設計です。EFSは、今秋後半から段階的にエンタープライズ向けに提供される予定です。
アクセスをリクエストする場合は、こちらのフォームからご記入ください。
生物学とサイバーセキュリティに対する安全対策
Anthropicによると、基本的な生物学・医学に関する無害な質問で、安全対策が誤って作動する頻度がFable 5の公開時と比べて85%減りました。回答する頻度が減ったという意味ではありません。
また、Fable 5.1をソフトウェアの脆弱性特定に使用できるようになりました。これにより、サイバーセキュリティ対策による介入回数が平均で約60%減少します。
アンチ蒸留メカニズム
Fable 5.1では、蒸留攻撃をより困難にするためのメカニズムが強化されています。新しいAPIアカウントでは、クロードの過去の思考の記録を保持したまま、クロードの過去のコンテキストを手動で編集することができなくなりました。これにより、蒸留者がクロードの思考を不正に抽出することを可能にしていた、一般的な蒸留手法が封じられます。
エージェントの安全性
Claude Mythos 5.1 が悪意のある要求やプロンプトインジェクション にどのように対応するかを評価しました。 この結果だけで、すべてのモデル・用途の中で最も安全とは断定できません。

■ Gray Swan IPI benchmark(グレー・スワン・アイピーアイ・ベンチマーク)
AI安全性の研究機関Gray Swan AIが作成したベンチマークです。エージェントシステムに対する間接的プロンプトインジェクション(Indirect Prompt Injection / IPI)攻撃に対する耐性や、指示無視・不正操作の発生率を評価します。
アライメント評価と限界
Claude Mythos 5.1 は、前バージョンの Mythos 5 よりもほとんどの指標において整合性が優れていることがわかりました。
しかし、モデルが承認や自動モードの分類器を回避してしまう場合があることが判明しました。
また、アライメント評価の適用範囲にも限界があります。非常に長いコンテキストの作業や、マルチエージェント環境における可視性が低下しています。
さらに、不可能なタスクの適用範囲も、現状では十分とは言えません。
Claude Mythos 5.1 の信頼できるアクセス
Claude Mythos 5.1は、2つの信頼できるアクセスプログラムを通じて利用可能になります。
- サイバー検証プログラム
参加申請はこちらから。
- ライフサイエンス検証プログラム
一般公開されている申し込みフォームは存在しません。
科学研究
以下はAnthropicが発表した研究例の紹介です。Gugenが実施・再現した研究成果ではありません。
分子設計
タンパク質設計でのヒット率は、12の標的全体で50%に達しました。(今日のタンパク質設計では、ヒット率は10~15%が一般的です。)

計算分析とモデリング
Claude Fable 5.1は、以前より25%正確な金星の標高マップの作成に成功しました。

計算生物学
7つのオープンソースの深層学習モデルを最大2.5倍高速化し、GPUコストを30~60%削減しました。
通常、このような最適化はパフォーマンスエンジニアのチームが数週間かけて行いますが、Mythos 5.1は、わずか数日でこれを実現しました。

出典・訂正
Anthropicの公式発表(確認日:2026年9月7日)。2026年9月7日、85%減の対象を「応答頻度」から「安全対策が誤って作動する頻度」へ訂正し、費用削減の条件と研究成果の主体を明記しました。

