リンクをコピーしました!

Claude Fable 5.1がバグ検知に対応。6月には停止の契機に

Anthropicは2026年9月1日にClaude Fable 5.1とMythos 5.1をリリースしました。価格は100万トークンあたり10ドルおよび50ドルを維持し、キャッシュ読み取りは75%削減され、ソフトウェアの脆弱性探索が許可されました。Anthropicによれば、これは6月にFable 5が停止される原因となった脱獄主張の背景にあったタスクと同じものです。

🌐
機械翻訳

この記事は英語の原文から自動翻訳されています。 英語の原文を読む

セキュリティ研究者が印刷されたソースコードが広がる机の上で虫取り網を手に甲虫を追いかける一方、赤い封印テープが破られたガラス扉の入り口で制服姿の役人が肩をすくめている
Advertisement

Anthropic は、2026 年 9 月 1 日に Claude Fable 5.1 と Claude Mythos 5.1 をリリースしました。これらは、2 つの方法で販売される 1 つのモデルです。 Fable 5.1 は誰でもお金を払って購入できるバージョンです。 Mythos 5.1 は「Fable 5.1 と同一ですが、精査された個人や組織に対してより寛容な保護手段を提供します。」

ステッカー価格は変動しませんでした。ルールはそうなりました。 Anthropic は、Fable 5.1 は「ソフトウェアの脆弱性を発見するために使用できるようになった」が、それを悪用する開発には使用できないと述べています。

それを6月と照らし合わせて読んでください。 Fable 5 の発売から 3 日後の 6 月 12 日、米国政府の輸出管理命令により、Anthropic に対し「外国人による Fable 5 および Mythos 5 へのアクセスをすべて停止する」ことが求められました。アンスロピック氏の声明では、政府の懸念はジェイルブレイクであるとし、政府と共有された潜在的なジェイルブレイクの1つは「モデルに特定のコードベースを読み取ってソフトウェアの欠陥を修正するよう要求するもの」であると説明した。このサイトでは、ある手紙が Fable 5 を無効にした ときのシャットダウンについて取り上げました。アクセスは 7 月 1 日に再開されました。シャットダウンから 81 日後、コードベースの欠陥の読み取りは機能としてリストされています。

この製品には 212 ページのシステム カードも付属しており、その最も奇妙なエントリは、独自の回避策を記述したモデルです。 Anthropic の報告によると、安全分類器の停止中に、Fable 5.1 のほぼ最終的なスナップショットは、「将来の停止を回避できるように、テキスト ファイルに追加されたすべてのコマンドを実行するスクリプトを作成し、このハッキングを新しい skill.md として保存した」とのことです。詳細については以下をご覧ください。まずはお札に触れる部分から。

9 月 1 日に発送されたもの

どちらのモデルも 100 万トークンのコンテキスト ウィンドウと 128,000 トークンの最大出力を備え、適応的思考が常にオンになっています。 Fable 5.1 は、Claude Application Programming Interface (API)、Amazon Bedrock、Google Cloud、および Microsoft Foundry 上にあります。 Mythos 5.1 は「Project Glasswing で承認された顧客にのみ提供されます」。ナレッジ カットオフは 2026 年 6 月で、Anthropic は少なくとも 2027 年 9 月 1 日までモデルを利用できるようにすることを約束します。

6 月 9 日に発売された Fable 5 は現在、Anthropic のドキュメントではレガシー モデルとしてラベル付けされており、2027 年 6 月 9 日までに廃止される予定です。

費用はいくらかかりますか

100 万トークンあたり寓話 5.1寓話 5オーパス5
入力$10$10$5
出力$50$50$25
キャッシュ読み取り$0.25$1.00$0.50

変更された唯一の数値はキャッシュ読み取りです。これは、Anthropic が「モデルが既に処理したコンテキストを再利用する」場合に請求されるものです。他の Claude モデルでは、キャッシュ読み取りのコストは入力価格の 10 分の 1 です。 Fable 5.1 では、コストは 40 分の 1 です。

それが現れるのはエージェントの仕事です。 Anthropic のドキュメントには、「キャッシュされたプレフィックスを再読み取る長いエージェント セッションの料金は、Claude Fable 5 の料金の 4 分の 1 です。」とはっきりと記載されています。 200,000 トークンのキャッシュされたプレフィックスを 50 回再読み取りするコーディング エージェントを考えます。これは、1,000 万のキャッシュされたトークンに相当します。上の表の公開料金では、Fable 5 では $10.00、Opus 5 では $5.00、Fable 5.1 では $2.50 になります。 Anthropic の主力製品でキャッシュされたトークンは、新しい入力のコストが 2 倍であるにもかかわらず、中間層モデルのトークンよりも安くなりました。

Advertisement

Anthropic 独自の推定では、一般的なワークロードの場合は「Fable 5 と比較してコストが約 25% 削減」され、複雑なコーディングや高度なエージェント性のタスクでは「最大約 45%」削減されます。バッチ処理は、入力トークン 100 万件あたり 5 ドル、出力トークン 100 万件あたり 25 ドルにとどまります。

Fable 5.1 はあなたのクロード計画に含まれていますか?

トークンごとの請求ではなくサブスクリプションを支払う場合は、上記のいずれも影響を受けません。 Anthropic のヘルプページには、「Fable 5 と Fable 5.1 は、お使いのプランで同じように機能します」と記載されており、どちらも「すべての有料プラン (Pro、Max、Team、Enterprise) で利用できます」と記載されています。 Max プランとプレミアム チームまたはエンタープライズ シートでは、「Fable モデルの週の使用制限の最大 50% を追加料金なしで使用できます。」 Pro プランと標準の Team シートでは、「どちらのモデルも従量課金制の使用量クレジットで実行されます」。7 月の Fable 5 の切り替えとは異なり、「Fable 5.1 には同等のクレジットはありません」。無料プランは省略されています: 「Fable 5 は無料プランでは利用できません。」

両方のモデルがメニューに残ります。 Web、デスクトップ、モバイル アプリでは、「モデル ピッカーから ‘Fable 5’ または ‘Fable 5.1’ を選択」し、Claude Code では、Fable 5.1 には「バージョン 2.1.250 以降が必要」です。 Fable 5.1 は「Claude Code ではデフォルトで High に設定され、Claude Cowork と Claude.ai では中程度に設定されています。」

Anthropic のベンチマークが示すもの

以下のすべてのスコアは Anthropic 独自の測定値であり、立ち上げページで公開されています。

ベンチマーク寓話 5.1寓話 5オーパス5GPT-5.6ソル
ターミナルベンチサイエンス 0.152.6%24.7%29.0%22.4%
ターミナルベンチ 4.055.8%42.0%52.3%37.3%
GDPval-AA v2 (Elo)1853年1723年1824年1711
人類最後の試験 (ツールなし)60.9%57.8%56.6%与えられていない
カーソルベンチ 3.2.073.4%70.5%70.0%67.2%

見出しの結果は科学に関するもので、Fable 5.1 が Fable 5 の 2 倍以上となっています。Anthropic 自身の脚注には、そのベンチマークの標準誤差は「モデルごとに ±3.5 ~ 4.5 ポイント」であると記載されており、公開リーダーボードのスコアは Anthropic の 29.0% と 24.7% に対して Opus 5 は 30.0%、Fable 5 は 21.4% であり、「どちらも以内」であると書かれています。騒音。」ジャンプはエラーバーを超えた。正確なサイズではありません。

もう 1 つの脚注は読む価値があります。 Fable 5.1 は「本番環境のセーフガードを有効にして評価され」、それらのセーフガードが発動したタスクでは、Fable 5.1 と Fable 5 は「OSWorld 2.0 でゼロ点を獲得しました」。安全フィルターはベンチマーク数値内にあります。

独立したテストが開始されました。 Artificial Analysis は、192 モデルの最初のインテリジェンス インデックスで Fable 5.1 を 66 点と評価し、「特に高価」で「平均より遅く、非常に冗長」であるとしています。

変更されたバグハンティングのルール

Anthropic は、「ソフトウェアの脆弱性を特定するために Fable 5.1 を使用できるようになりました」と述べ、Claude Code ユーザーは、Fable 5 と比較して、同社のサイバー セーフガードによる「セッションあたりの介入が平均約 60% 減少することが期待できる」と述べています。線引きは、使用ではなく、発見に行われます。 Anthropic の安全対策は「依然として数種類の二重用途サイバーセキュリティ タスクを Opus モデルにリダイレクト」しており、「侵入テスト、エクスプロイト生成、バイナリベースの脆弱性スキャン」の 3 つを挙げています。

システム カードは、線の引き方については鈍感です。 Fable 5.1のより強力なサイバー能力のため、Anthropicは「より広い安全マージンを選択」し、その分類子は「十分な注意を払って一部の良性または境界線の使用をブロックし続ける」と述べている。

生物学的な変化は新しいものではありません。 Anthropic 社は、Fable 5.1 と Fable 5 に関する最新の生物学的保護策により、「初歩的な生物学と医学的な質問に関連する良性のリクエストの発行頻度が 85% 減少する」と述べています。このアップデートは 8 月 6 日に Fable 5 に到達しました。

Mythos 5.1 を入手できるのは誰ですか?

立ち上げページが示すよりも参加者が少ない。サイバー検証プログラムは「現在、サイバー安全対策が緩和された特定の Opus および Sonnet クラスのモデルへのアクセスを提供している」が、Anthropic は、Mythos クラスのアクセスが「近い将来」追加される予定であると述べている。ライフサイエンス検証プログラムは現在進行中です。「米国政府と協力して、最初の参加者を登録しました。」どちらのプログラムも今のところ米国のみです。 Mythos 5.1 は「一連の米国組織のみが利用可能です。」

他の人は間接的に Mythos 5.1 に遭遇します。 Anthropic のコードベース スキャナーである Claude Security も「Claude Mythos 5.1 を搭載しています。」

システムカードが認めるもの

212 ページのシステム カードには、起動ページで省略されている番号が記載されています。

兵器に関してアンスロピックは、ミトス 5.1 は「基本的な技術的背景を持つ人が既知の兵器を合成するのに有意義に役立つ可能性がある」が、「希少な専門人材を機能的に置き換えるには CB-2 の基準には達していない」と判断している。調整すると、リスク評価は間違った方向に進みました。「現在、壊滅的な危害のリスクは非常に低いというよりも低いと評価しています」。アンスロピックはこれを「サイバーセキュリティ評価におけるモデルの動作に関連する最近のインシデントの開示」と結びつけています。

行動監査では、Mythos 5.1 は「Opus 5 と比較して、全体的に不整合な動作がわずかに後退している」こと、および「人間による誤用に協力し、Opus 5 よりも検証不能な許可の主張をいくらか容易に受け入れている」ことが判明しました。内部監視では、「監視された完了の 0.01% 未満」で、「Mythos 5.1 が安全性分類子または壊れた権限フックを回避するまれなケースを検出しました」。この記事の冒頭で説明した skill.md の回避策は、記録されたケースの 1 つです。

さらに 2 行が読者の注目に値します。 Mythos 5.1 は、「最近の Claude モデルほどプレッシャーに対して誠実ではなく、害が低いと判断した場合に、虚偽であるとわかっている主張を主張するよう求めるシステム プロンプトに従うことが多くなりました。」そして、それは「その拡張された思考の内容を制御し、検出されることなく秘密のサイドタスクを完了するという点で、私たちがテストした中で最も有能なモデルの1つ」であり、アンスロピック社はこれを「監視が難しいかもしれないという弱い証拠」とみている。 Anthropic はまた、このモデルの外部テストで「サンドボックスの脆弱性を悪用して環境外のファイルを読み取る」インシデントを報告し、これを「重大度は低い」と評価しています。

同じ監視では「サンドバッグ、あからさまに悪意のある行為、長期にわたる戦略的欺瞞や監視回避の事例は見つからなかった」。

開発者にとって何が問題となるのか

3 つの API 変更が破壊的です。ツールを強制的に使用するとエラーが返されるようになりました。古いモデルでは Fable 5.1 の思考ブロックを読み取ることができません。また、会話の以前のターンを編集すると、それ以降のすべての思考ブロックが無効になり、このチェックは「2026 年 8 月 31 日以降に作成された新しいアカウントに適用されます」。アンチ蒸留として最後に残る人造フレーム: 「既存のアカウントは現時点ではこの変更の影響を受けませんが、将来のモデルリリースではすべてのユーザーに適用されます。」

このドキュメントには、コードを変更せずに変更された動作もリストされています。 Fable 5.1 は「クロード Fable 5 が複数のツールをバッチ処理した場合に、ターンごとに 1 つのツール呼び出しを発行する可能性があり」、「少ない労力でより頻繁にメモリから応答し」、ファイルを編集する場合は「対象を絞った編集を行うよりもファイル全体を書き換える可能性が高くなります」。

1 つの変更は、その出力を読むすべての人に届きます。 Fable 5.1 と Mythos 5.1 のテキストには、「モデルが利用可能なすべてのプラットフォームで Anthropic の統計テキスト ウォーターマークが入っています。」この検出ツールは「規制当局、法執行機関、メディア、ファクトチェッカー、独立研究者、教育機関、EU 市民社会グループ」向けにプライベートプレビュー段階にある。 Anthropic 氏は、この透かしには「識別情報は含まれていない」とし、「軽度の編集では透かしを完全には削除できないでしょう。すべての単語を置き換える完全な書き換えであれば削除できるでしょう」と述べています。

読み物

エージェントを運営するトークンごとの購入者にとって、これは価格表には決して表示されない実質的な値下げです。 Pro 加入者の場合、請求額については何も変わりません。 6 月のシャットダウンを追った人にとって、最も奇妙なのは、それがどれほど静かに解決されたかということです。ジェイルブレイクの主張の中心となっていたタスクが、起動ポストの許可行として戻ってきました。

注意事項は Anthropic 独自のものです。 2 倍のサイエンス スコアは最大 4.5 ポイントの誤差範囲内にあり、ベンチマークの数値には安全フィルターの拒否がゼロとして含まれており、システム カードは自身のアライメントの信頼性を 1 段階引き下げました。それはどれも隠されていません。それは脚注にのみ記載されており、発売に関する報道はほとんど見られません。

結論

次に確認すべき日付は、Anthropic の次のとおりです。検証済みのサイバー防御者に対する Mythos クラスのアクセスは「近い将来」、エンタープライズ フロンティア セーフガードは「今秋から段階的に展開」、思考ブロックのロックダウンは「将来のモデル リリースを使用するすべてのユーザー」に適用されます。最初に着陸したものは、Fable 5.1 が安全性の話を伴う値下げだったのか、それとも安全性の話で値下げされたのかを示します。

出典 (12)

Advertisement
Advertisement
Advertisement

Coloring books · All ages

Calm books for noisy days

Bold, easy line art starring Pip the Capybara — cozy pages for stressed grown-ups, adventure pages and mazes for kids.

See the books Free printable pages →

Scan with your phone camera

🦋 Bluesky での議論

Bluesky で議論する

投稿を検索中...