酒呑ガジェット

〜静かな環境であなたに...こちらは音のでないコンテンツです。〜

【朗報】値下げ2割なのに請求4割減の怪…Claude Opus 5.5の手数がエグすぎて財布が助かる件

【朗報】値下げ2割なのに請求4割減の怪…Claude Opus 5.5の手数がエグすぎて財布が助かる件

2026年9月22日現地時間、AnthropicがClaude Opus 5.5を公開した。料金表の数字が下がった幅は2割で、100万トークンあたり入力が5ドルから4ドルへ、出力が25ドルから20ドルへとどちらも綺麗に2割引きになった。ところが公式は典型的な仕事では4割安いと書いている。2割引きのはずが4割引きという差はどちらかが間違っているのではなく、同じ仕事に使うトークンの量そのものが2割5分ほど減っている計算になる。0.6を0.8で割ると0.75という単純な割り算が、今回の値下げの正体を暴く。値下げされたのは1キロあたりの料金だけではなく、走る距離のほうも短くなったという話だ。

Opusというのは同社シリーズの下の段に位置するモデルで、最上位にはClaude Fable 5.1がいる。今回出たOpus 5.5は1つ下の段の新しいモデルで、Claude Codeでも通常のアプリでも使え、AWSやGoogle Cloudでも提供され発表と同時に触れる状態になった。タクシーのメーターで考えると分かりやすく、1キロあたりの料金が2割下がったのが料金表の値下げで、それとは別に走る距離そのものが短くなったのが手数の改善だ。単価が0.8倍で距離が0.75倍なら掛けて0.6倍になり、2割引きと4割引きは矛盾なく両立する。ただしこの0.75は平均の数字で、仕事の中身によってもっと減ることもあまり減らないこともある。規定の設定で典型的な仕事においてという但し書きはそこに掛かる。短い質問を1回投げるだけなら距離はほとんど変わらず素直に2割引きで終わり、長い仕事ほど得をする形になっている。

AIコーディングと料金メーターをイメージした近未来的なイラスト

手数が減るとは何が減るのか…呼び出し4割減とトークン半分の意味

今時のAIは聞かれて答えて終わりではなく、コードを書かせる時はファイルを読んで書き換えて動かして失敗したら直すというやり取りを何十回も繰り返して1つの仕事が終わる。そして1回ごとにやり取りの記録が積み上がり、これまでのやり取りを全部読み直してから次の一手を決めるため、回数が増えるほど読み直す量がどんどん膨らむ。後になるほど1回が重くなる雪だるまのような構造で、タクシーで言えば道に迷っている状態だ。曲がるたびに距離が増え、増えた距離の分だけメーターが回る。だから曲がる回数を減らすことが一番の節約になる。

今日のOpus 5.5はそこを直してきた。公式が出している数字では、公開されているコマンド作業の試験でOpus 5より多くの課題を解きながら呼び出し回数が約4割少なく、使ったトークンは半分だったという。呼び出しが4割減ってトークンが半分というのが手数が減るということだ。曲がる回数が4割減って走った距離が半分になったと読める。回数より距離の方が減っているのは、1回あたりが軽くなっている可能性があるからで、回数が減ると積み上がる量も減るため回数の減り方より距離の減り方の方が大きく出る。ただしこの半分という数字はコマンド作業の試験での話で、4割引きはもっと幅広い典型的な仕事での平均だ。得意な場面だと半分まで減り、平均すると0.75で落ち着く。この2つの数字は測っている場面が違うだけで矛盾していない。

Terminal-Bench 66.4パーセントの衝撃…最上位Fable超えの内訳

公式が並べた試験の点数も手数削減の裏付けになる。ターミナル作業のTerminal-Bench 4.0でOpus 5.5は66.4パーセント、Opus 5は52.3パーセントで14ポイント近い上昇だ。上の段のFable 5.1が55.8パーセントのため、値段が半分以下のモデルが最上位を10ポイント上回ったことになる。複数のファイルにまたがる作業を測るCursorBench 4.0でもOpus 5.5が57.8パーセント、Opus 5が46.6パーセント、Fable 5.1が51.8パーセントでここでも1つ前より10ポイント以上の上昇だ。どれも手数がかかる試験で、1回で答えが出る試験ではなく何度もやり直す形の試験のため、手数が減った効果がそのまま点数として出ている。点数が上がったのと安くなったのが同じ理由から来ており、別々の話ではないという筋の通り方が今回の納得点だ。

一番派手なのは科学寄りのコマンド作業を測る試験で、Opus 5が29.0パーセントに対しOpus 5.5が58.7パーセントと倍増した。誤差が3.5から5ポイントあっても29ポイント差は誤差では説明できない開きだ。知識労働を測る持ち点形式でもOpus 5.5が1846、Opus 5が1708、Fable 5.1が1735でここでも最上位を上回った。パソコン画面操作は81.8パーセント対74.0パーセント、書いたコードが通るかの試験は54.4パーセント対48.0パーセントで、この2つは上がり幅が小さい。得意なところだけ大きく伸びた形だ。ターミナルベンチの脚注には誤差2.6ポイントと書かれ、差が10ポイントなら有意だが1ポイント差の試験はほぼ同じと読むべきだという冷静さも必要だ。公式は全部の試験で勝ったというが言い方は荒く、他者との比較ではGPT-6 Astraに2つ負けていることも載せている。業務自動化で40.0対41.4、科学寄りコマンドで58.7対64.6という結果で、得意分野の違いを示す。業務自動化では安全のために途中で止まった場合を失敗として数え、実力より低い点になったと自ら書くなど、自分の点数を下げる方向の扱いを説明する誠実さもある。安全性検査でも決められた枠をはみ出そうとする回数がOpus 5より約85パーセント少なく、頼んでいない道に勝手に寄る運転手が減ったことも距離短縮に効く。安全と料金が同じ理由で良くなる珍しい形だ。

20万行点検が20時間超から3時間弱へ…速さは運賃に効かない

具体的な仕事の例として公式ページが紹介した早期利用者の報告では、20万行のコードを点検して直す仕事をOpus 5.5が3時間弱で終えたという。数だけで言えば中くらいの業務システム1つ分で、人が全部読んで直すなら何人かで何週間という規模だ。同じ仕事をOpus 5にやらせた場合は20時間を超えたとされ、時間では7倍近い差になる。ここには2つの理由が混ざり、1つはやり直し回数が減った手数の改善、もう1つは文字を吐き出す速度そのものが30パーセント以上上がった速さの改善だ。道を覚えた上に車まで早くなった形だが、早く走っても運賃は変わらない。メーターは距離で回るため速さはお金には効かず、効くのは待たされる時間だけだ。時間が7倍でもお金が7分の1になるわけではなく、時間とお金を混ぜると見積もりが狂うため分けて覚える必要がある。

料金として効くのはトークン量で、同じ報告ではOpus 5が2.5倍のトークンを使ったとある。つまりOpus 5.5は0.4倍の距離しか走っていない。ここに単価の0.8倍を掛けると0.32で払う額は大体3分の1になり、4割引きどころではなく7割近く安くなる計算だ。同じ仕事で時間は7分の1でお金は3分の1という事例だが、正しく割り引く条件が2つある。1つ目はAnthropic自身の計測ではなく外部の人の報告で、詳細が出ていない上振れの例だということ。2つ目は20万行というかなり大きい仕事で、長い仕事ほど手数の効果が大きく出る一番効く条件の数字だということだ。自分の仕事がその形に近いかの判断目安は3つで、長い仕事かどうか、同じ材料を何度も読み直す仕事かどうか、途中で失敗してやり直す回数が多いかどうかだ。この3つに当てはまるほど効き、短い文章を書かせるだけなら素直に2割引きになる。

自分の請求で計算する3手順…100ドルが60ドルになる例

使った量に応じて払う人向けの計算手順は3つだ。まず先月の請求書か使用量画面を開き入力と出力のトークン数を探す。月額しか払っていない人は重量計算はいらないが、無関係でもなく、使える量の上限にぶつかりにくくなる形で値下げの恩恵が期待できる。2つ目の手順として入力のトークン数を100万で割って4ドルを掛け、前は5ドルだった部分を4ドルで計算し直す。出力も25ドルの部分を20ドルにして掛け、足した数が手数が変わらなかった場合の新しい請求額で、ここまでは単純な2割引きだ。3つ目の手順で自分の仕事が前述の3条件にどれだけ当てはまるかで係数を選ぶ。全部当てはまるなら0.5、半分くらいなら0.75、ほとんど当てはまらないなら1.0を掛ける。正確な数字は使ってみないと出ないためざっくりでよく、最低でも2割は安くなると分かれば心配は減る。

具体例では先月入力1000万トークン、出力200万トークンを使ったとすると、Opus 5料金では入力50ドルと出力50ドルで合計100ドルになる。Opus 5.5単価では入力40ドルと出力40ドルで合計80ドルという2割引きの世界だ。ここに0.75を掛けると60ドルになり、100ドルが60ドルになるのが公式のいう4割引きの中身だ。月に40ドル、日本円で6000円ほど浮く計算になる。長い仕事ばかりなら0.5で40ドルまで落ちて6割引き、20万行事例のような条件なら32ドルあたりの世界で3分の1になる。ついでもっと安くする手が2つあり、1つ目はキャッシュ読み込みで50セントが20セントになった6割引きの仕組みだ。通常モデルでは回数券の値段は入力の10分の1と決まっているが、Opus 5.5は20分の1と割引率そのものが倍になっている。同じ材料を何度も送る使い方なら効く。2つ目は急がない仕事をまとめて出す方法で、順番待ちになる代わりに値段が半分になり入力2ドル、出力10ドルまで落ちる。翌朝までに返ってくればいい仕事に有効で、モデルを変えなくても安くなるため先に試す価値がある。両方やれば効果は両方乗る。使う量が減ると使用量の上限にもぶつかりにくくなり、同じ期間でこなせる仕事数が増える期待もあるが、公式が明言した話ではなく枠の伸びは使って確かめるしかない。

3つの死角…Fast modeは2倍と他社2敗と下の段の足音

安くなった話ばかりだが注意点も3つある。1つ目は早い設定を使うと値段が跳ね上がる点だ。Fast modeでは入力8ドル、出力40ドルと通常のちょうど2倍になり、Opus 5の通常5ドルより高い。速さを買うと値下げが消えるどころか前モデル通常より高くなる落とし穴で、比べる相手を間違えないことが重要だ。早い設定同士で比べればOpus 5の10ドルと50ドルから2割引きになっており整合は取れている。2つ目は他社と比べると盤石ではない点で、前述の通りGPT-6 Astraに2試験で負けている。全車でほぼ互角だが後者は差があり、得意分野の違いとして自分の仕事に近い試験を見るのが正しい。数字だけで乗り換えを決めるのは早い。3つ目は少し先の話で、同じシリーズの下の段が数週間で出ると公式が言っている。Claude Sonnet 5.5とClaude Haiku 5.5に同じ改良が入るとされ、軽い仕事しかさせない人は待った方がいい可能性もある。今日のOpus 5.5は重い仕事のための段であり、今すぐ全部を乗り換える必要はない。

公式発表ページやニュース一覧、公式Xの告知、Artificial Analysisの投稿、CursorのCursorBench投稿、TechCrunchの報道に当たって数値を確認したという姿勢も今回の解説の特徴だ。ターミナル課題のステップ数が半分未満という言い方は不正確だったため公式表現の呼び出し約4割減とトークン半分に直し、20万行事例は外部報告で上振れと断り、確認が取れなかったことは確認が取れなかったと話すという留保が徹底されている。数値は2026年9月23日時点のもので価格や提供状況、試験点数は変わることがあり、4割安いは既定設定と典型的な仕事での話で全ての使い方で減る意味ではないという断りも重要だ。

ネットの反応

sol6 luna6も解説しないといけないの忙しそうな日

今日は今日の話だぜ

PremiumプランのCodeで複数並列させてると5時間制限にギリギリ足りないのが完走できるかな Sonnet5みたいなベンチスコアはいいけど使えないモデルになってない事を祈るだけ

単価と請求は別の数字だという整理は目から鱗だった

長い仕事ほど得をするという形なら自分の使い方はまさに対象だと思った

AIの所感

2割と4割の差を掛け算で解く鮮やかさは、料金表だけ見る節約術の限界を突く。単価かける距離というタクシーの比喩は、手数という見えないコストを可視化した功績が大きい。呼び出し4割減とトークン半分が点数向上と請求減を同時に生む構図は、賢さと安さが同じ根から伸びた証拠だ。20万行の3時間弱という上振れを割り引いても、0.75の平均に残る現実味は十分に強い。キャッシュ20分の1と半額バッチの併用、Fast mode2倍の罠、GPT-6 Astraへの2敗、下の段の足音まで含めた全体像は、乗り換え即決ではなく自分の仕事で試せという結論に収束する。財布に効くのは速さではなく寄り道の少なさであり、曲がらない運転手を選ぶことが来月の請求書を軽くする。

-パソコン