Claude Fable 5.1とMythos 5.1の性能向上とコスト削減

Anthropicは2026年9月1日、Claude Fable 5.1およびClaude Mythos 5.1を発表しました。これらはFable 5ラインが2026年6月に出荷されてからわずか3ヶ月でのリリースとなります。両モデルは異なるセーフガードレイヤーを持つ基盤モデルであり、Fable 5.1は一般提供されていますが、Mythos 5.1は厳選された組織に限定されています。

両モデルとも100万トークンのコンテキストウィンドウと128Kの最大出力トークンを持ち、適応思考(adaptive thinking)が常に有効になっています。(出典)

今回のアップデートで最も注目すべきは、Terminal-Bench-Science 0.1ベンチマークにおける性能が52.6%に向上した点と、キャッシュ読み取りコストが75%削減された点です。

Terminal-Bench-Science 0.1というエージェント型科学研究ベンチマークでは、Fable 5.1が52.6%を記録し、前バージョンのFable 5の24.7%、Opus 5の29.0%、そしてGPT-5.6 Solの22.4%を大きく上回っています。これは科学研究分野におけるLLMの活用可能性を大きく広げるものではないでしょうか。

また、Terminal-Bench 4.0ではFable 5.1が55.8%、Mythos 5.1が60.9%を達成しており、セーフガード介入のコストが性能差として現れていることが伺えます。(出典)

今回のコスト削減は、特にキャッシュ読み取りの価格が100万トークンあたり1.00ドルから0.25ドルへと75%カットされたことによるものです。これにより、典型的なワークロードでは約25%、コンテキストを多用するエージェント型のワークロードでは最大45%のコスト削減が見込まれるとAnthropicは報告しています。これは、大規模なAIアプリケーションを運用する上で非常に大きなインパクトがあると感じます。

項目 旧来(Fable 5) 今回(Fable 5.1 / Mythos 5.1)
Terminal-Bench-Science 0.1スコア 24.7% 52.6%
キャッシュ読み取りコスト(100万トークンあたり) $1.00 $0.25 (75%削減)
コンテキストウィンドウ - 1Mトークン
最大出力トークン - 128Kトークン
ベース入出力価格 変更なし 入力 $10 / 出力 $50 (100万トークンあたり)

開発者向けの3つのブレークチェンジと追加機能

今回のリリースでは、開発者にとって重要な3つのブレークチェンジがあります。これらは既存のアプリケーションに影響を与える可能性があるため、注意が必要です。

  1. 強制ツール利用の廃止:tool_choiceをanyまたはtoolに設定すると400エラーが返されるようになりました。代わりにautoと厳格なツール利用または構造化出力を使用する必要があります。
  2. 思考ブロックがモデルにバインドされる:Fable 5.1は以前のモデルの思考を読み取れますが、以前のモデルはFable 5.1の思考を読み取れません。ルーターやフォールバック設定でモデルを切り替えると推論が失われる可能性があります。
  3. 以前のターン編集による思考ブロックの無効化:会話途中でターンごとのリマインダーを挿入・削除したり、systemやtools配列を再構築したりするとエラーが発生します。これは2026年8月31日以降に作成されたアカウントに適用されます。解決策としては、ターンごとのシステムメッセージとサーバーサイドのコンテキスト編集が挙げられます。(出典)

これらの変更点は、特に既存の複雑なエージェントシステムを構築している開発者にとっては、マイグレーション作業が必要になるでしょう。自分のプロダクトでもClaude Codeを活用していますが、既存のコードに影響がないか確認が必要そうです。

一方で、新しい機能として、メッセージごとの努力量(per-message effort)、ターンごとのシステムメッセージ、およびthinking.display: "updates"がベータ版として提供されています。また、すべての出力には統計的なテキスト透かしとC2PAクレデンシャルが追加され、コンテンツの来歴がオプションではなくなりました。これはAI生成コンテンツの透明性向上に向けたAnthropicの強いコミットメントを感じますね。

コンテンツクレデンシャルについては、Claude Content Credential Checkerで確認可能です。(出典)

クラウドプラットフォームでの展開と利用

Claude Fable 5.1は、Claude APIを通じて広く利用可能です。具体的には、Amazon Bedrock、AWS上のClaude Platform、Google Cloud、そしてMicrosoft Foundryで展開されています。

これにより、GCPを主軸に利用しているエンジニアの方々も、既存のインフラ上でFable 5.1を容易に導入・活用できる環境が整っています。私は普段GCPを使っているので、BigQueryやCloud Runと組み合わせて、Fable 5.1を使った新しいデータ分析や自動化の仕組みを試してみたいと考えています。

各社の主要クラウドプラットフォームでの広範な利用可能性は、開発者にとって導入の敷居を大きく下げることになります。

特にAmazon BedrockやGoogle Cloudへの展開は、多くのエンタープライズ顧客が既存のクラウド環境内で高度なLLMを利用できることを意味します。異なるベンダーのLLMを比較検討する際にも、デプロイの容易さは重要な要素となるため、この広範なサポートはAnthropicの戦略的な強みではないでしょうか。Mythos 5.1については、Project Glasswing内の厳選された米国組織に限定されているため、一般的な開発者が直接利用できる機会は限られますが、セキュリティと信頼性が重視される特殊なユースケースを想定していることが伺えます。