リンクをコピーしました!

AIが安くなるほど、請求額は高くなる

トークンあたりのAI価格は約2年間で280分の1以下に暴落したにもかかわらず、AIの請求額は上昇し続けています。自律型エージェントのワークロードが消費量を倍増させ、GitHubはCopilotを従量課金制に移行し、Anthropicは直前で価格改定を一時停止しました。このパラドックスの背後にある計算を解説します。

🌐
機械翻訳

この記事は英語の原文から自動翻訳されています。 英語の原文を読む

オフィスのデスクで1ペニーの硬貨を穏やかに眺める会計士と、その背後で今にも崩れ落ちそうにうねるペニー硬貨の巨大な津波

主なポイント

  • 価格低下は確実である: GPT-3.5レベルの性能を有する人工知能(AI)モデルの照会は、2022年11月から2024年10月の間に100万トークンあたり$20.00から$0.07へと低下し、280倍以上の低下を記録した。
  • それでも請求額は上昇した: FinOps財団が調査した組織の98%が現在AI支出を積極的に管理しており、わずか2年前の31%から上昇している。
  • 2026年6月は定額料金が消えた月: GitHubは6月1日にすべてのCopilotプランをメーター化されたトークンベースの課金に移行した。Anthropicも同様の分割を発表したが、実施予定日の6月15日に一時停止した。
  • 犯人は価格ではなく量である: エージェント的ワークロードは、チャットクエリよりもタスクあたり数桁多くのトークンを消費する。安い単価と急増する消費量を掛け合わせると、より大きな請求額になる。これはジェボンズのパラドックスであり、データセンター規模で実行されている。

$20プランが機能しなくなった月

3年間、取引は単純でした:AIベンダーに固定月額料金を支払い、モデルをビュッフェのように使い放題にするというものでした。2026年6月、そのビュッフェは閉じられました。

6月1日、GitHubはCopilotの「プレミアムリクエスト」を全プランのGitHub AI Creditsに置き換え、「各モデルの公開API料金に従い、入力、出力、キャッシュされたトークンを含むトークン使用量に基づいて」使用量が消費されました。2週間後、Anthropicは独自版を推し進める予定でした:Claude Agent SDK(Software Development Kit)とサードパーティエージェントの使用をサブスクリプションプールから外し、Proプランの$20からトップティアの$200までの範囲の個別月額クレジットに移動させるというものでした。それは起こりませんでした。変更が実施予定だった6月15日、Anthropicは一時停止し、「現在のところ何も変わらない」と述べ、「プランを実際の使用パターンと調整するために取り組んでいる」と述べました。

この価格改定の波が本当に奇妙な点は、AIトークンが過去最も安くなった正にその時に到来したことです。両方のことが同時に真実である理由を理解することで、AI請求額が実際にどこに向かっているのかを説明できます。

大規模なデフレーションは実在している

ベンダー側の話から始めましょう。それは真実であるという利点があります。

AIの進歩に関する最も引用されている年次会計であるStanfordのAI Indexは、MMLU(Massive Multitask Language Understanding、標準的な知識ベンチマーク)でGPT-3.5と同等のスコアを獲得するモデルの照会コストが、「2022年11月に100万トークンあたり$20.00から2024年10月までにわずか$0.07に低下した」と述べており、約18ヶ月間で280倍以上の削減です。タスクによっては、同じレポートによると推論価格は年間9倍から900倍まで低下しています。ソフトウェアの下では、機械学習ハードウェアコストは年間約30%低下し、エネルギー効率はおよそ年間40%向上しています。

その規模の価格崩壊はAI予算を四捨五入の誤差にするはずでした。代わりに、反対のことが起こりました。

消費の爆発

クラウド金融運用(FinOps)の業界団体であるFinOps財団は、その2026年FinOps状況レポートで、その質問に答えた693人の実務家に基づいて、98%の組織が現在AI支出を管理していると述べています。2025年の63%、2024年の31%から上昇しています。AI費用管理はチームが開発する必要がある第1位のスキルセットとしてランクされました。縮小している費用を中心に学問全体を構築することはありません。

変わったのはトークンの価格ではありません。単一の作業がいくつのトークンを消費するかです。

2023年代のチャットボット交換は1つのリクエストでした:質問入力、回答出力、端から端まで数千トークン。エージェント的なコーディングセッションはまったく異なるものです。エージェントはリポジトリを読み、計画し、ツールを呼び出し、その出力を読み、失敗し、再試行し、自分の作業を検証します。これらのステップのそれぞれは、その前のすべての累積コンテキストを携えた新しいモデル呼び出しです。4秒のオートコンプリートと45分の自律型リファクタリングは、ほぼ3桁のトークンギャップの両端に位置しています。

Gartnerはこれがどこに至るかについて日付を付けました。2026年6月下旬、リサーチ企業は、AIコーディングエージェントの支出が2028年までに平均的なソフトウェア開発者の給与を上回る軌道にあると予測し、テクノロジーリーダーのほぼ4分の1がすでに月額1開発者あたり$200から$500のAIコーディングトークンを費やしており、約6%が月額1開発者あたり$2,000以上を費やしていると報告しています。

その特定の予測が当てはまるかどうかはともかく、方向性は議論の余地がありません。ユニットは安くなりました。ワークロードは巨大になりました。

静かな価格改定の解剖

定額料金サブスクリプションはチャットボット時代の価格だったのに対し、エージェント時代はその計算式を破壊しました。その後は、組織的な値上げというより、ますます気まずい一連の修正でした。

GitHubが最初に行き、最も遠くまで行きました。 新しいCopilotスキームの下では、プラン価格は同じままですが、各プランは現在、マッチングされたAI Creditsの手当を含みます:Proは月額$10で$10のクレジット、Businessはユーザーあたり$19で$19、Enterpriseは$39で$39を含みます。1クレジットは$0.01の価値があります。コード補完とNext Edit提案はメーター化されないままなので、カジュアルなオートコンプリートユーザーは何も気付きません。エージェントユーザーは、対照的に、現在、公開API(Application Programming Interface)料金で実行されているトークンメーターを消費しています。

Anthropicは試しましたが、たじろぎました。 プランはチャットと公式Claude Codeコマンドラインインターフェース(CLI)を標準サブスクリプション制限に保つ一方で、Agent SDK、ヘッドレスclaude -pコマンド、およびサードパーティアプリが、それらの制限から引き出すのを停止し、代わりに現行API料金で請求し、それらの月額クレジットで緩和されたものです。6月15日の一時停止は、Wall Street Journalが、OpenAIが自社のAPIの急激な値下げを検討していると報告したときに来ました。これは、一方的に実効価格を引き上げることを不快な動きにしたでしょう。1つのベンダーが提供し、その競争相手がローンチ日に放棄する価格改定は、業界がまだ床を見つけていないことを示しています。

より微妙なレバーはトークナイザーです。 Anthropicの独自の価格設定ドキュメントは、Claude Opus 4.7以降のモデルが「同じテキストに対して約30%多くのトークンを生成する」トークナイザーを使用していることに注意しています。同じリスト価格、同じテキスト、より多くの課金対象ユニット。サイトはOpus 4.7が変わらない見出し価格で立ち上げられたときにこの正確な動きをフラグしました。

そして、リスト価格自体は最前線で静かに低下を停止しました。 Anthropicの価格表は、Claude Sonnet 5を2026年8月31日までの100万入力トークンあたりの初期$2と100万出力トークンあたり$10で示しており、その後標準価格の$3と$15が発効され、予定された50%の増加。新しいトップティアのClaude Fable 5は$10インと$50アウトでリストアップされ、Claude Opus 4.8の$5と$25の2倍。予算ランクでさえ上がりました:Claude Haiku 4.5は$1と$5でリストアップされ、廃止されたHaiku 3.5の$0.80と$4を上回っています。この1つの価格表で、すべてのティアが上方に価格改定されています。残りのデフレーションは、競争の中で、より安い競争相手とオープンウェイトモデル、現職のリスト価格ではなく存在します。

データ

全体のパラドックスは1行の算術に適合します。タスクの費用は、トークンの価格にタスクが消費するトークンの数を掛けたものです:

Ctask=Ptoken×TtaskC_{task} = P_{token} \times T_{task}

2022年から2024年の間に、一定の品質に対してPtokenP_{token}はおおよそ280倍低下しました。しかし、現在支配的なワークロードでは、TtaskT_{task}は数百から数千の係数で増加しました。2番目の係数が最初のものが縮む速度より速く成長する場合、すべての個々のトークンがより安くなっても、CtaskC_{task}は上昇します。

新しいCopilotプランの数字を実行して、メーターがどのくらい速く排出されるかを確認します。Claude Opus 4.8のような価格の最前線モデルでのエージェント的セッションを取得します。100万入力トークンあたり$5と100万出力トークンあたり$25。150万入力トークンを処理して100,000出力トークンを生成するセッションは、それらのレートで正確に$10.00の費用がかかります:

Line itemVolumeRate (per M tokens)Cost
Input tokens1,500,000$5$7.50
Output tokens100,000$25$2.50
Session total$10.00

このようなセッション2つで、Copilot Businessシートは$19の月額クレジット手当全体を使用済みになりました。その後のすべてはメーター化されたオーバーセッジです。定額料金はより高くなりませんでした。人々が実際に今仕事をする方法をカバーするのを停止しました。

偽の床

では、ここで悪役は誰ですか?あなたの理論を選んでください。

1つの読み方は皮肉的です:定額料金はサブシディを受けた土地掴み、そして6月はクローバック、サブシディを受けた床が壊れ始めた瞬間でした。もう一つの読み方はつまらないです:誰も何も計画する必要がありませんでした。API料金で数百ドルのコンピュートを消費できるワークロードに対して設定された安い定額料金は、悪意が不要な独自に失敗する算術です。

証拠はつまらない読みを支持しており、ツイストがあります。これは供給の絞りではありません。Anthropicの一時停止が落ち着いた同じ週に、Reutersはブルームバーグニュースによると、Metaは過剰なAIコンピューティング容量をクラウドビジネスを通じて販売する計画があると報告しました。容量は不足していません。最前線規模の消費は、チャット用に構築された価格設定モデルを単に上回っています。

そして顧客はどこかに行く場所があります。Reutersは7月2日に、新しい低価格のチャイニーズAIモデルがAnthropicとOpenAIの最前線オファリングに追いついていると報告しました。Tom’s Hardwareはサブスクリプションが価格設定の壁に当たると、企業がワークロードをチャイニーズおよびオープンウェイトモデルにシフトすることを文書化し、特にAI予算を拡張するためです。すべてのメーター化されたインボイスは、1つのAPI呼び出しで離れたより安いモデルの広告です。それは、顧客の親善よりも、価格改定がどのくらい遠くまで行くことができるかのチェックです。

1865年の韻

これのどれも新しくありません。1865年、経済学者William Stanley Jevonsは、石炭燃焼技術がより効率的になるにつれて、効率が石炭動力産業をより多くの場所で経済的にしたため、イギリスの総石炭消費量は低下ではなく上昇したことを観察しました。安い単位、より多くの総燃焼。石炭をトークンに置き換えると、AI業界は同じ結果で同じ実験を実行しています。

より近い韻は光ファイバーです。1990年代後半、通信キャリアは、需要をはるかに上回る速度で成長した容量を構築するために多大な資金を借りました。そして、ドットコムバブルの崩壊の後に資金調達が枯渇した場合、彼らの債務負荷はWorldComやGlobal Crossingなどの大手企業を取り下げた一連の破産を引き起こしました。その時代の教訓は、需要が偽物だったということではありません。需要は成長し続けました。それは単に、それを提供するために構築されたインフラとビジネスモデルよりも遅く成長し、修正は一度に到着しました。AI動画生成の経済学はすでにこの壁に当たっています;テキストエージェントはそれをスローモーションで当たっています。

次に何が起こるか

短期的な軌跡は6月の残骸から見えます。

メーター化が広がります。GitHubはすでに、政治的に生き残ることができるバージョンが「プラン価格は変わらず、エージェント使用量がメーター化される」であることを示しており、Anthropicでの一時停止は撤退ではなく改訂として読みます。会社は計画を放棄ではなく再調整しようとしていると述べました。Sonnet 5の予定された50%のリスト価格引き上げが発効され、ミッドティア価格がオープンウェイト代替品にワークロードを失うことなく実際に上昇できるかをテストする9月1日に注視してください。

ルーティングレイヤーが興味深い戦場になることを期待してください。企業はすでに最前線モデルと日常作業の約10分の1の費用がかかる代替品をペアリングしています。すべてのトークンがメーター化されると、リクエストの簡単な大多数を安いパスに送ることは最適化ではなく、ゲーム全体になるのを停止します。そして「token FinOps」が職種になることを期待してください。98%の組織がAI支出を管理し、第1位のスキルギャップがAI費用管理である場合、誰かがメーターを所有するために雇用されています。

これはあなたにとって何を意味するのか

AI ツールでコードを書く場合:

  • 6月にメーター化された課金に移動したツールを確認してください。オートコンプリート層は依然として実質的にフラットです。エージェント層はそうではありません。
  • モデルをタスクに一致させてください。フロンティアモデルを安いモデルが処理する作業で実行することは、現在は可視的な行アイテムであり、ティア間の価格ギャップは桁違いです。

AI 予算を所有している場合:

  • シートではなく、タスクごとのトークンで予測してください。シートベースの予算は2026年のオーバーランの発生方法です。
  • ベンダーのリスト価格を答えではなく、数学の開始として扱ってください。トークナイザーの変更と消費の成長は、価格表が変わらないときでも実際のコストを移動させます。

よくある質問

トークン価格が低下し続ける場合、これは自分自身を修正しませんか?

ユニット価格は低下し続ける可能性があります。Stanfordのデータは、タスクに応じて年間9倍から900倍の低下を示しています。しかし、タスクごとの消費は価格低下よりも速く成長し、エージェントはまだより自律的になっています。デフレーションが自分の使用を上回ることに予算を賭けることは、2年連続して負け賭けでした。

Anthropicは請求変更をキャンセルしたのか、それとも単に遅延させたのか?

キャンセルではなく、一時停止されました。同社は「現在のところ何も変わらない」と述べ、プランを実際の使用パターンと調整するために取り組んでいます。変更を生み出した構造的な圧力は消えませんでした。

これはちょうどAIベンダーの価格釣り上げですか?

証拠は反対を指しています。公開API料金でのメーター化された課金は、重いユーザーに静かにサブシディを提供した定額料金よりも透明性が高く、低価格のチャイニーズおよびオープンウェイトモデルからの競争は、誰が達成できるかを制限します。本当の話は、価格設定の単位(1ヶ月のアクセス)がコスト(トークン)の単位に一致しなくなり、不一致が最終的に壊れたということです。

結論

安いトークンの時代と巨大なAI請求額の時代は、インボイスの反対側から語られた同じ話です。デフレーションは知能を無謀に費やすのに十分安くしました。エージェントは支出を工業化し、メーターを隠した定額料金サブスクリプションは2026年6月に算術で死にました。現在進行中の修正は不快ですが正直です:可視メーター、実際の価格、およびタスクの費用が最終的にそれを実行するのに必要なものについてあなたに真実を告げる市場。その真実に基づいて構築された予算は良好に機能します。ビュッフェがオープンのままでいることに基づいて構築された予算は機能しません。

出典

Advertisement

🦋 Bluesky での議論

Bluesky で議論する

投稿を検索中...