なぜ Claude Fable 5 は一度停止されたのか

6月12日、米国政府が突然 Claude Fable 5 と Claude Mythos 5 に輸出規制を課しました。これにより、両モデルは外国籍のユーザーに提供してはならなくなったのです。

Anthropic は国籍をリアルタイムで検証する技術を持たなかったため、全ユーザーに対してアクセスを停止せざるを得ませんでした。

この背景にあったのは、Amazon の研究チームによる報告です。彼らは Fable 5 のセーフガード(安全装置)をバイパスする手法を発見し、その手法がモデルにソフトウェアの脆弱性を特定させ、それを悪用するコードまで生成させていることを示しました。(出典)

正直なところ、これはかなりシビアな状況だと感じます。モデルの安全性に対する懸念が政府レベルで引き上げられるというのは、AI の開発側にとって大きなプレッシャーになるはずです。

Anthropic の調査—「実は他のモデルでも同じ」

Anthropic がこの問題の深刻度を調べたところ、Amazon が報告した脆弱性識別技法は Fable 5 に固有のものではなかったことが判明しました。

  • 複数のモデルで同じ脆弱性を識別可能:Claude Opus 4.8、GPT-5.5、Kimi K2.7 など
  • エクスプロイトコード生成も再現可能:Haiku 4.5、Sonnet 4.6、Opus シリーズ全般、GPT-5.4/5.5、Kimi K2.7

Anthropic の見解では、これはサイバーセキュリティの防御的な業務範囲内のルーチン業務に過ぎず、Mythos レベルの独自の危険性を露呈したものではないとしています。

この調査結果は、実装の汎用性を示唆しており、エンジニアの視点からは「他社モデルでも似たような結果が出ている」という状況がわかります。一つのモデルだけが問題なのではなく、この種の潜在的リスクはより広い範囲で存在する可能性があるということです。

新しい分類器と復活のタイムライン

6月30日、米商務長官 Howard Lutnick はAnthropic に対する規制を解除しました。条件として、同社が以下を約束しています。(出典)

  • セキュリティリスクの主動的な検出と対処
  • 米国政府とのプロトコル・基準の協働開発
  • 悪意のある活動を政府に報告する体制の構築

この条件の下で、Anthropic は Amazon の報告に対応する 新たなセーフティ分類器(安全フィルタ)を導入しました。このフィルタは、報告された特定の技法—つまり「脆弱性を特定し、それを悪用するコードを生成する」という一連の行為を検出・ブロックするよう訓練されています。

Fable 5 と Mythos 5 の利用可能範囲は以下のとおりです。

モデル 復活日 対象ユーザー 備考
Claude Fable 5 2026年7月1日 全世界ユーザー Claude Platform・Claude.ai・Claude Code・Claude Cowork で利用可
Claude Mythos 5 2026年6月26日(部分)→7月1日(完全復活) 米国のサイバーセキュリティパートナー組織 防御的な研究用途に特化

(出典)

開発者にとっての実際の影響

Fable 5 の価格は従来どおり、入力トークン1000万あたり10ドル、出力トークン1000万あたり50ドルに設定されています。

ただし、復活直後の期間(7月7日まで)は、Pro・Max・Team・一部 Enterprise プランのユーザーが週間使用量の50% までを Fable 5 に充てることができます。それ以降は、使用クレジットでの課金に切り替わります。

個人的には、このタイミングでの安全性強化と公開再開はバランスの取れた判断だと感じます。AI モデルの能力を制限するのではなく、特定の悪用パターンを遮断するというアプローチは、実用性と安全性の両立を示唆しています。Claude Code や自動コーディングツールを活用する開発者にとっては、強力な選択肢が戻ってきたことになります。

業界への波及効果

このケースから読み取れる構造は、単なる一企業の問題ではなく、AI モデルの規制と実用性に関わる より大きなパターンになる可能性があります。

米国政府がサイバーセキュリティ関連の機能を理由に規制を検討する一方で、防御側の業務遂行にはそうした機能が必要という緊張関係は、今後の AI 規制の枠組みに影響を与えるでしょう。Anthropic が新分類器で「特定の悪用パターンのみをフィルタリング」するアプローチを採用したことも、他の企業にとって参考になるはずです。