リンクをコピーしました!

Fable 5は3日間しか持たなかった。午後5時21分の1通の手紙がそれを終わらせた

米国政府は輸出管理指令を利用し、ローンチから3日後の6月12日にAnthropicに対しFable 5とMythos 5のシャットダウンを強制した。Anthropicが主張するジェイルブレイクの内容は、モデルにソフトウェアのバグ修正を依頼したことだった。そのわずか2日前、Anthropicはまさにこのような政府の権限を公に求めていた。

🌐
機械翻訳

この記事は英語の原文から自動翻訳されています。 英語の原文を読む

暗いスーツを着た手が大きな工業用の赤いブレーカースイッチを引く一方で、ガラスの向こうにある巨大なデータセンターのホールが1列ずつ暗くなっていく様子。政府の命令によるAIモデルのシャットダウンを象徴している

主な論点

  • ワシントンが稼働中のAIモデルを回収: 2026年6月12日、米国政府は輸出管理指令を発令し、ローンチからわずか3日後のAnthropicに対し、すべての顧客向けにClaude Fable 5およびClaude Mythos 5の提供を停止することを強制した。
  • 停止の引き金は議論の的: 政府が示した証拠について、Anthropicは「限定的かつ非普遍的」な単一のジェイルブレイク(安全対策の回避)にすぎないと主張している。その内容はモデルにコードベースを読み込ませてバグを修正させるというもので、すでに他の公開モデルも備えている機能だという。
  • 最悪のタイミング: 輸出管理指令が下るわずか2日前、Anthropicは危険なAIの展開を政府が法的に阻止する権限を持つべきだとする政策大綱を公表していた。同社は自ら求めた権限を政府に与えられる形になったが、同時に求めていた適正手続(due process)は省略された。
  • 真の争点はアーキテクチャ: Fable 5とMythos 5は、同じ基盤モデルでありながら異なる安全対策ラッパー(分類器)をまとったものである。Fableに対する確実なジェイルブレイクの主張は、Anthropicが世界最強のサイバーセキュリティモデルと呼ぶシステムへ誰もがアクセス可能であることを意味する。

午後5時21分の1通の手紙

6月12日東部時間(ET)午後5時21分、Anthropicに1通の手紙が届いた。 その日の夜が終わる頃には、同社が「これまで一般に提供したどのモデルの能力をも凌駕する」と説明していた人工知能(AI)モデルは、地球上のすべての顧客に対してアクセスが遮断され、消え去っていた。

その手紙は、国家安全保障上の権限に基づいて発行された米国政府からの輸出管理指令だった。それは、Claude Fable 5およびClaude Mythos 5への一切のアクセスを「米国内外を問わず、またAnthropicの外国人従業員を含む、あらゆる外国籍の個人」に対して停止するよう命じていた。 同社は、この命令の事実上の効果により、全顧客向けに「Fable 5とMythos 5を突如として無効化せねばならなくなった」と述べている。 理由は明白である。公開されているAIサービスの中に、チャット画面でパスポートの確認を行うような仕組みは存在しないからである。なお、他のすべてのAnthropicモデルへのアクセスは継続している。

Fable 5がローンチされたのは6月9日のことだった。 その寿命はわずか3日間だった。

これまで、各国政府が自国内でのアプリ使用を禁止したり、チップメーカーを制裁したり、半導体の輸出を制限したりしたことはあった。しかし、企業に対して自社の代表的な旗艦モデルを世界中で停止させる命令を下すというのは、真に新しい国家権力の行使である。Anthropicによれば、このモデルは「数億人もの人々」に展開されていたという。 そして、この命令の受け手となった企業は、過去4ヶ月にわたりTrump政権と対立を続け、さらに直前の2日間で「政府はまさにこのような権限を持つべきだ」と主張していた当事者そのものであった。

指令が実際に行っていること

まずはその仕組みから見てみよう。これは見出しが示唆するよりもはるかに奇妙なものである。これは裁判所の命令でもなければ、消費者保護法に基づく製品回収でもない。Anthropic自体が提案していたブロッキング権限は、同社の言葉を借りれば「現行の法律や議会で出されている既存の提案を超えたもの」であり、つまりAI専用の回収法案などは存在しなかった。 代わりに政府が手を伸ばしたのは、通常はチップや兵器の設計図、暗号技術などが外国の敵対勢力に渡るのを阻止するために使用される法的ツールである「輸出管理指令」だった。

この適用範囲こそが、事実上の完全なシャットダウンをもたらした。米国内やAnthropic内部を含め、あらゆる場所での外国籍の個人によるアクセスを禁止したことで、フィルタリングによる指令への対応は事実上不可能になった。Anthropicは、手紙には「国家安全保障上の懸念に関する具体的な詳細は記載されていなかった」と述べている。 同社によれば、政府が発見したとされる問題について、これまでに「口頭での証拠」しか提示されていないという。

このことは、今後の展開において極めて重要である。正式な法制定であれば、法廷で一行ずつ争うことができる。しかし、何も公表されず口頭だけで正当化された指令に対しては、ターゲットにされた側は全容が見えない主張に対して反論せねばならない。この戦いでAnthropicの味方をしなくとも、このプロセスが透明性とは正反対のものであることは誰の目にも明らかである。

正当化の根拠とされた「ジェイルブレイク」

Anthropicによると、政府はFable 5の安全システムをバイパスする、すなわち「ジェイルブレイク」する方法を把握したと信じているようだ。 ジェイルブレイクとは、安全対策によって拒否されるはずの動作をモデルに行わせるようなプロンプトを巧妙に作成することを意味する。

Anthropicによるこの手法の描写は、ストーリーをほとんど不条理な方向へ傾かせる。同社によると、主張されているジェイルブレイクは「本質的に、モデルに特定のコードベースを読み込ませてソフトウェアの欠陥を修正するよう依頼することで構成されている」という。 これは奇抜な攻撃ではない。地球上のあらゆる企業のセキュリティチームが日々行っている、日常的な防御的セキュリティ業務の記述そのものである。Anthropicは、指令の基礎となったとされるデモンストレーションと報告書を調査した結果、この手法は「OpenAIのGPT-5.5を含む」他の公開モデルでも特別なバイパスなしで検出できる「すでに知られている軽微な脆弱性の少数」を浮き彫りにしただけであると判断した。 競合する他社モデルに対して、これに類する命令が公開されたことはない。

ただし、同様に重視すべき2つの留保事項がある。第一に、これは完全にAnthropic側による性格付けである点だ。指令も報告書も非公開であり、政府はAnthropicが目にしていない、あるいは説明しようとしない証拠に基づいて行動している可能性がある。第二に、指令が下る前から、Fable 5に対するジェイルブレイクの主張は公に存在していた。ローンチの数日後、有名なAIレッドチームメンバーであるPliny the Liberatorは、彼のチームがFable 5の安全分類器をバイパスしたと公表し、動作するソフトウェア悪用(エクスプロイト)コードを含め、モデルが拒否すべき素材を生成していることを示すスクリーンショットを投稿した。 TechTimesは6月12日にこれらの主張を報じたが、政府の行動との関連性には言及しておらず、また今回の政府指令と結びつける公的な証拠も存在しない。

Anthropicの対論は、否定ではなくプロセスに関するものである。同社は、ローンチ前の数週間にわたり、米国政府、英国のAI安全研究所(UK AISI)、および民間の第三者と共にFableの安全対策について「合計で数千時間」に及ぶレッドチームテストを実施し、「これまでのところ、テスターは誰一人として普遍的なジェイルブレイクを発見できていない」と述べている。 同時に同社は、どのプロバイダーにとっても完璧なジェイルブレイク耐性は恐らく存在しないことも認めており、だからこそ安全対策と監視、そして攻撃を検出・調査するための30日間のデータ保持要件を組み合わせているのだと説明している。

1つのモデル、2つの名前

Fable 5に対するジェイルブレイクの主張が、なぜ国家安全保障の機構を始動させるのかを理解するには、そのアーキテクチャを知る必要がある。Fable 5とMythos 5は兄弟モデルではない。異なる服を着た同じ基盤モデルなのだ。

Fable 5は一般公開バージョンである。これには、サイバーセキュリティ、生物学・化学、あるいはモデル蒸留に関連する要求を検出し、それらへの応答を下位モデルであるClaude Opus 4.8に引き渡し、それが実行されたことをユーザーに通知する安全分類器が搭載されている。 Anthropicによれば、これらの安全対策は保守的に調整されており、平均して「セッションの5%未満」でしか作動しないという。 この上限値で計算してみると、その規模が浮き彫りになる。100万セッションにつき、最大5万セッションがルート変更に遭遇する可能性がある。Anthropicはローンチ時にこのトレードオフを指摘しており、今回の停止声明でも、安全対策が強力すぎるため「多くのユーザーから範囲が広すぎるという苦情が寄せられている」と認めている。

Mythos 5は、米国政府と共同で運営されている制限付きアクセスプログラムであるProject Glasswingを通じて、サイバー防御者やインフラプロバイダーの小規模なグループにのみ提供されている、同じモデルの「一部の領域で安全対策が解除されたバージョン」である。 Anthropicはこれを「世界中のどのモデルよりも強力なサイバーセキュリティ能力」を持つモデルと呼んでいる。

この設計こそがすべての核心である。FableとMythosの差は能力ではない。分類器の有無だ。したがって、誰かがFable 5のジェイルブレイクに成功したと主張するとき、それは実際には、Project Glasswingによる審査を経ずに一般市民がMythos級の攻撃的サイバー能力にアクセスできることを意味する。もしそれが事実なら、この2階層の安全アーキテクチャ全体が崩壊することになる。Anthropicの弁明は、開示されたジェイルブレイクは「完全に無害な応答か、あるいはMythos固有の能力向上をもたらさない軽微な発見」であるというものだ。 しかし政府は、どうやら納得しなかったようだ。

わずか2日前にAnthropicはこの権限を求めていた

ここが、政策論の講義で教えられることになるであろう部分である。指令が届く2日前の6月10日、Anthropicは米国政府がフロンティアAIに対して新しい法的権限を持つべきだとする政策大綱を公表していた。 その提案は明確で、モデルが壊滅的なリスクをもたらす場合、「政府は自社の展開をブロックまたは阻止する法的権限を持つべきである」とし、それをグローバルな年間売上高に連動した民事罰で裏付けるというものだった。 この枠組みは、10²⁵ FLOPs(モデル訓練に使用された算術ステップの総数)以上の規模で訓練され、AI関連の年間売上高が5億ドルを超えるか、またはAIの研究開発に10億ドル以上を費やす企業が構築したモデルに適用される。 これらの基準は、まさにFable 5が属するクラスのモデルを捉えるために設定されている。

同エッセイは、その権限の失敗パターンについても警告していた。Anthropicは、政策立案者は「過度に広範な、あるいは強権的な規制権力を避けることも必要である」と書き、ブロック権限が乱用されるのを防ぐための具体的なガードレールを提案していた。

その2日後、政府はAnthropicのモデル展開をブロックした。同社が提案したような、独立した評価者、公表されたテスト、適正手続による保護を伴う法定プロセスを通じてではなく、口頭で証拠が提示された輸出管理書簡によってである。Anthropicの声明は、このジレンマに明らかな困惑を示しながら対応している。同社は、政府が危険な展開をブロックできるようにすべきであるという主張を再確認しつつ、それは「透明性があり、公正で、明確で、技術的事実に基づいた法定プロセスの一部であるべきだ」とし、そして決定的な一撃を加えた。「今回の行動は、それらの原則に準拠していない。」

誤解のないように言っておくが、今回の指令がAnthropicのエッセイに対する意図的な報復であったという公的な証拠はなく、それを意図的な罰と解釈するには現時点で誰も証明できない仮定を必要とする。単純な解釈としては、すでに同社と対立していた政府が、真新しいフロンティアモデルに関するジェイルブレイクの報告を受け、手元にある最も乱暴な道具に手を伸ばしたというものだろう。しかし、立証されている日付だけでも、その対比は強烈である。Anthropicは水曜日に適正手続を伴うキルスイッチを求めた。金曜日に、同社は政府がすでにキルスイッチを持っており、適正手続はオプションにすぎないことを知ったのだ。

4ヶ月に及ぶ公然の争い

これらの出来事は決して突発的に起きたわけではない。今回の指令は、本サイトが2月に同社が「Claudeを米国人の大量監視や自律兵器の誘導に使用することを拒否した」と報じて以来、追跡してきた対立の最新ラウンドである。国防総省はこれに対し、Anthropicを国家安全保障上のサプライチェーンリスクに指定し、政府全体での使用禁止指令を下した。

その闘いの現実の記録は公になっている。3月初旬、Nextgovは、連邦機関がAnthropic製品との取引を停止するよう求めるTrump大統領の指示を受け、同社との契約を打ち切り始めたと報じた。財務省はAnthropic技術の使用停止を確認し、国務省および保健福祉省(HHS)もワークフローから同社のツールを段階的に排除する動きを見せた。 しかしその後、司法が介入した。2026年3月26日、カリフォルニア州北地区連邦地方裁判所は、大統領指令の執行を一時停止する予備的差し止め命令を下し、4月3日までに一般調達局(GSA)は「Anthropicの技術を2026年2月27日より前の現状に戻す」と発表した。

言い換えれば、Anthropicは法廷での契約争いにおいて勝利しつつあったのだ。今回の輸出管理指令は、差し止め命令の対象外である第二の戦線を開くものであり、それは政府によるClaudeの購入ではなく、Anthropicの商業的旗艦そのものを標的としている。それが偶然なのか戦略なのか、まさにその疑問に対して政府側は何の答えも出しておらず、何も公表していない。

データ

確認されたタイムラインは、過酷な1週間に凝縮される:

日付 (2026年)出来事
6月9일Fable 5およびMythos 5のローンチ。AnthropicはFableの能力がこれまで一般公開したどのモデルをも上回ると発表
6月10日Anthropic、危険なAI展開をブロックする政府権限を求める大綱を公表
6月12日 (日中)TechTimes、レッドチームテスターのPliny the Liberatorによるジェイルブレイクの公表を報道
6月12日 午後5:21 ET輸出管理指令が到着。Anthropicは両モデルを無効化

無効化されたモデルの経済的側面も同様に具体的である。Fable 5とMythos 5の価格は、入力10万トークンあたり10ドル、出力100万トークンあたり50ドルに設定されており、これは招待制の前身モデルである「Claude Mythos Preview」の「半分以下の価格」であるとAnthropicは述べている。 この1文から、先週までのフロンティア級サイバー能力のコストを逆算できる:

PMythosPreview>2×PFable5    PMythosPreview>20 (入力)  /  100 (出力)P_{\text{MythosPreview}} > 2 \times P_{\text{Fable5}} \;\Rightarrow\; P_{\text{MythosPreview}} > 20 \text{ (入力)} \;/\; 100 \text{ (出力)}

(100万トークンあたりのドル換算)。このローンチにより、世界最強のサイバーセキュリティモデルの価格は半分以下になり、Claudeアカウントを持つすべてのユーザーにフィルタリングされた形で提供されることになった。そしてその3日後、フィルター(分類器)自体が国家安全保障上の問題となったのである。

次に何が起きるか

この前例こそが現在のストーリーであり、それはあらゆる方向に影響を及ぼす。

フロンティアAI開発企業にとって、モデル公開の計算式は一変した。Anthropic自身の警告が最も鋭い指摘となっている。「限定的な潜在的ジェイルブレイク」が回収の理由になるのであれば、その基準は「すべてのフロンティアモデルプロバイダーにおける事実上のすべての新モデルの展開を停止させることになる」。 サンフランシスコのすべてのAI開発企業の法務担当者は、今夜この手紙を読み、午後5時21分の手紙に備えた独自の緊急対策計画の起草を始めた。

企業顧客にとって、教訓はさらに厳しいものだ。生産ワークロードをFable 5に移行していた企業は、自社のシステム稼働時間に何の非もないにもかかわらず、推奨モデルを一夜にして失うことになった。今後はエンタープライズ向けAI契約においてモデル停止条項が追加され、マルチモデルアーキテクチャが一般化し、数日ではなく数年間市場で生き残ってきた実績のあるモデルに対して静かなプレミアムがつくことになるだろう。Anthropicは今回の事態を「誤解」として対処しており、アクセスの復旧に努めているとし、声明から24時間以内にさらなる技術的詳細を公表することを約束している。 それまでは、他のすべてのAnthropicモデルが利用可能である。

政策論争においては、この皮肉が論拠として固定化するだろう。Anthropicを含む、法律によるAI監視の支持者たちは、自分たちが提案したガードレール(公表された証拠、独立した評価、明確な不服申し立て経路)を伴わないブロック権限がどのようなものか、実例を手に入れることになった。政府のいかなる役割にも反対する勢力は、今回のエピソードを、国家権力など到底信用できないという証明として利用するだろう。双方が、まったく同じ3日間の出来事から自らの主張を組み立てている。

結論

ブランド名を剥ぎ取ってみれば、今週起きたことはこうだ。ある企業がフロンティアAIモデルを出荷し、透明性のある法的プロセスを通じて自社のようなモデルを規制するよう政府に求め、その後、極めて不透明なプロセスによって稼働を停止させられた。その証拠はごく限られたサークル以外には提示されておらず、停止の理由となった能力は、同社によれば競合他社のモデルがすでに提供しているものであるという。

政府は一般に知られていない何かを握っているのかもしれない。それは十分にあり得ることであり、機密証拠の存在こそが、今回の指令を擁護する最も強い論拠である。しかし、公表されていない証拠を口頭で提示し、法的枠組みもないまま商業技術を回収させる国家権力は、安全規制体制とは呼べない。それは「裁量」である。そして、政権が過去4ヶ月にわたり公然と罰してきた企業に対して行使された裁量は、証拠がテーブルの上に提示されるまでは、微塵も信用に値しない。この状況を打開する道は、このストーリーに登場するほぼ全員が「望んでいる」と主張している方向である。すなわち、キルスイッチを法律に明記し、証拠の公表と独立したレビューを義務づけ、次の午後5時21分の手紙がその論拠を自ら示さねばならないようにすることだ。

出典

Advertisement

🦋 Bluesky での議論

Bluesky で議論する

投稿を検索中...