本文へスキップ
AI-Papers

米政府がClaude Fable 5/Mythos 5を即時停止、安全性戦略が招いた皮肉な構図

(更新: 2026年9月6日)
米政府がClaude Fable 5/Mythos 5を即時停止、安全性戦略が招いた皮肉な構図
  • 米政府は2026年6月12日、ジェイルブレイクの可能性を根拠にClaude Mythos 5とClaude Fable 5の即時停止を命令した
  • Anthropicは「ごく限定的な潜在的脆弱性」と反論し、数億人のユーザーへのアクセスが失われたと問題視している
  • 同基準を業界全体へ適用すれば最先端モデルの新規デプロイが事実上停止するとAnthropicは警告し、IPO計画への影響も懸念される

停止命令の経緯

2026年6月12日、米政府はAnthropic社に対してClaude Mythos 5とClaude Fable 5の即時停止を命令しました。公式の名目は輸出規制措置として実施されましたが、Anthropicによると実際の引き金となったのはClaude Fable 5に発見されたジェイルブレイク(安全制限の迂回)の可能性です。

Anthropicが明らかにしたところによれば、政府側から提示された根拠は口頭ベースの情報にとどまっており、書面や具体的な技術的証拠の開示は受けていないとのことです。同社は停止命令を受けて声明を発表し、対応を検討中であることを明らかにしました。

この展開は、AI業界でも特に安全性へのコミットメントを前面に押し出してきたAnthropicにとって、複雑な状況をもたらしています。OpenAIやGoogleなど競合他社との差別化要素として安全性を強調し続けてきた同社の姿勢が、今回の政府による精査を招く要因の一つとなった可能性があります。

停止対象の2モデル

Claude Mythos 5は2026年4月初旬にプレビュー公開されたAnthropicの最高性能モデルです。ソフトウェアの脆弱性を発見する能力が特に高く、「Project Glasswing」と呼ばれる管理プログラムを通じて、Amazon、Apple、Google、Microsoft、CrowdStrikeなど限られた認定組織にのみ提供が限定されていました。高度なサイバーセキュリティ機能を備えるため、当初から厳格な利用管理が課せられていました。

Claude Fable 5は停止命令の3日前にリリースされた一般公開モデルです。Mythos 5をベースにしつつ、サイバーセキュリティや生物学などハイリスク領域への回答を制限する安全ガードレールを強化したバージョンとして位置付けられていました。リリース時点では最高性能の一般公開AIモデルと評価されており、独立型分類器システムによる多層防御も実装されていましたが、今回の停止命令の対象に含まれました。

Anthropicの反論

Anthropicは声明の中で「ごく狭い範囲の潜在的なジェイルブレイクの発見が、数億人のユーザーに展開された商用モデルを回収する根拠になるとは考えない」と明確に主張しています。同社はさらに、問題となった操作手法と同等の機能が競合他社の公開モデルで既に利用可能であることも指摘しました。

技術的な観点からAnthropicが説明するところによると、問題となった操作はコードベースを解析してソフトウェアの欠陥を特定する行為であり、サイバーセキュリティ専門家が防御目的で日常的に実施するレベルのものだとしています。多層防御として実装された独立型分類器システムが悪用を検知・防止する役割を担うはずであったとも主張しています。

既存ユーザーへの影響として、数億人規模でモデルへのアクセスが失われた状態が続いています。代替モデルへの案内など具体的な救済策についてAnthropicから正式な発表は限られており、有料プランを利用していたユーザーや企業を中心に業務への支障が生じています。

図1: 安全性訴求が規制対応を招いたフィードバックサイクル
図1: 安全性訴求が規制対応を招いたフィードバックサイクル

AIガバナンスへの波紋

今回の停止命令は、AI企業が安全性をどのようにアピールするかという戦略全体に問いを投げかけています。Anthropicが積極的に訴えてきた「高リスクの可能性があるAI」というメッセージが、政府によるモデル停止の根拠として機能する構図となりました。安全性の透明な開示が規制の呼び水となるならば、他のAI企業がリスクコミュニケーションをどのように設計するかという判断にも波及します。

Anthropicは「この基準を業界全体に適用すれば、全ての最先端モデルプロバイダーによる新規モデルの展開が事実上停止する」と警告しています。競合他社はAnthropicのリスク強調型の情報発信を以前から批判的に評価しており、今回の事態を受けて業界内の見方の相違が改めて表面化しています。

同社が準備を進めるIPO計画にとっても、上位モデルへのアクセスが断たれた状態は投資家心理に影響を与える可能性があります。AI規制の先行きの不透明さがバリュエーション(企業価値評価)を押し下げるリスクも指摘されており、AIガバナンスと産業成長の緊張関係を示す具体的な事例として、今後の政策論議でも参照されることになりそうです。

シェア:

投稿には GitHub アカウントが必要です。投稿内容は公開され、利用規約に反するものは予告なく削除します。