リンクをコピーしました!

Claude Opus 5が登場:Fable 5の半額に

Anthropicは2026年7月24日、Claude Opus 5を入力100万トークンあたり$5、出力100万トークンあたり$25で提供開始しました。これはOpus 4.8と同価格であり、Fable 5のちょうど半額です。現在、Claude Maxのデフォルトモデルであり、Claude Proで最も強力なモデルとなっています。

🌐
機械翻訳

この記事は英語の原文から自動翻訳されています。 英語の原文を読む

2台の同じ黒いサーバーラックが並んでおり、片方の前には高く積まれた金塊、もう片方の前にはそのちょうど半分の高さの金塊が置かれている

何が起きたか

Anthropicは2026年7月24日にClaude Opus 5をリリースした。 価格は入力100万トークンあたり$5、出力100万トークンあたり$25で、これは後継対象となるOpus 4.8とまったく同じ価格である。

その据え置き価格こそが話の核心だ。Anthropicが広く一般提供している中で最も高性能なモデルであるClaude Fable 5は、入力100万トークンあたり$10、出力100万トークンあたり$50かかる。 Opus 5はその半額でありながら、Anthropic自身のベンチマークチャートではFable 5とほぼ肩を並べており、その差はわずか数分の一パーセントポイントに過ぎない。

APIの請求額ではなくサブスクリプションで支払っているユーザーにとっては、この変化は本人が意識しないうちにすでに起きている。Opus 5は「Claude Maxの新しいデフォルトモデルであり、Claude Proにおける最強のモデル」だ。

詳細

  • 価格: 入力100万トークンあたり$5、出力100万トークンあたり$25で、Opus 4.8と同一。
  • コンテキストウィンドウ: 100万トークン、最大出力は12万8000トークン。
  • モデルID: Claude API上ではclaude-opus-5
  • Fastモード: Opus 5の基本価格の2倍で利用可能。

価格を決めるダイヤル

今回の目玉機能は、性能そのものではない。ひとつのつまみだ。

Opus 5には、「タスクの完了やプロンプトへの回答にモデルがどれだけの労力をかけるかを切り替えられる」機能が搭載されており、低・中・高の3段階設定がある。 Anthropicはこれを、「顧客が知能を最適化するか、あるいはより速く安い結果のためにトークンを節約するかを選べる」コントロールだと説明している。

これは見た目以上に重要な話だ。トークンは課金の単位であり、モデルが消費するトークン数を変える設定は、タスクのコストそのものを変える設定でもある。ベンチマーク結果が特定のエフォートレベルで示されているのも同じ理由からだ。CursorBench 3.2では、Opus 5は最大エフォート設定時に限り、タスクあたりのコストがおよそ半分でありながらFable 5の最高スコアと0.5パーセントポイント差にまで迫る。 設定を下げれば、スコアも料金も一緒に下がる。

Frontier-Bench v0.1では、Anthropicの発表によるとOpus 5はOpus 4.8のスコアを2倍以上に伸ばしながら、タスクあたりのコストは低いという。 ただしこれはベンダー側の数値として扱うべきだ。Anthropicはベンチマーク結果を、元データを伴わないチャート画像の形で公開しており、現在出回っているスコアは表から抽出されたものではなく、グラフから目視で読み取られたものである。独立した再現検証はまだ行われていない。

Anthropicが認める弱点

より興味深い告白は安全性のセクションにあり、読み違えやすい内容でもある。

Anthropicは「Opus 5はリスクの高いデュアルユース能力においてフロンティアを前進させていない」とし、「生物学研究と攻撃的サイバーセキュリティの両分野でMythos 5に後れを取ったままだ」と述べている。 ここは注意深く読む必要がある。というのも、この比較は予想されるものとは違うからだ。Mythos 5はフラッグシップモデルではない。これはAnthropicの招待制プログラムであるProject Glasswingのもとで、防御的サイバーセキュリティ業務向けに提供される別モデルであり、自己登録による利用はできない。

この区別こそが要点だ。Anthropicは自社の大衆向けモデルのハッキング能力を、フラッグシップモデルではなく専門のセキュリティモデルと比較していたのである。Anthropic独自の脆弱性ベンチマークであるOSS-Fuzzでは、公開されたチャートによると、Opus 5は脆弱性の発見においてMythos 5に近い成績を収める一方、実際に動作するエクスプロイトを構築する能力では大きく劣る。 バグを見つけることはできるが、それを兵器化する能力は明らかに劣っている。同系統の先行モデルであるMythos Previewは、本サイトが3週間で27年分の隠れたバグを発見したとして取り上げたモデルである。

こうした自制を美徳と見ない向きもある。Hugging FaceのCEOであるClem Delangue氏は、「クローズドなモデルAPIには、正当なセキュリティ業務の多くにフラグを立てて拒否してしまうガードレールがある。攻撃の分析は、その準備と見た目が非常に似ているからだ」と主張した。

そしてOpus 5はスタックの頂点でもない。Anthropicは「より高度なプロジェクト、モデルが何日にもわたって自律的に処理する可能性のあるものも含め、依然としてFable 5を推奨している」。 Fable 5は、米国の輸出管理指令によって6月に全顧客向けに無効化を余儀なくされたものの、7月1日に復活し、7月12日には従量制の利用クレジットへと移行したモデルであり、その地位を維持している。

読み解き

世代を跨いで価格を据え置くことは、値下げには見えない値下げである。Anthropicはその数字自体を下げたのではなく、その数字が買えるものを引き上げたのだ。100万トークンあたりの単価ではなく、タスクあたりのドルで予算を組む買い手にとっては、それこそが唯一意味のある比較であり、しかもエフォートダイヤルというコストをさらに押し下げる第二のレバーとともに実現した。

ただし注意点として、上記の性能に関する主張はすべてAnthropic自身の評価に基づいており、その多くはラベルのないチャートから読み取られたものだ。価格については誰でも検証できる。だが、その知能については社外の誰もまだ検証していない。

結論

Anthropicは表示価格には手を付けず、その代わりに性能を動かした。Claude MaxやProの利用料を支払っているなら、あなたはすでにそれを使っている。トークン単位で支払っているなら、エフォート設定こそが今や請求額を左右するレバーだ。そして作業内容が攻撃的セキュリティに少しでも関わるものであれば、Anthropicはこれがそのためのモデルではないとはっきり伝えている。

出典 (5)

Advertisement

🦋 Bluesky での議論

Bluesky で議論する

投稿を検索中...