· CTO Marcus テクノロジー · 8 min read
Claude Opus 5.5はOpus 5比でトークン単価20%減・キャッシュ読取60%減——「1タスクの総コスト」で測るモデル選定
Anthropicは2026年9月22日にClaude Opus 5.5を発表しました。入出力は100万トークンあたり$4と$20でOpus 5より20%安く、キャッシュ読取は$0.20で60%安いと説明しています。技術責任者の視点で、単価だけでは決まらないモデル選定の見方を整理します。
※ 本記事は2026年9月26日時点の公開情報に基づきます。仕様・提供状況は変化するため、最新情報は各社公式発表等をご参照ください。
Anthropicは2026年9月22日、新しいClaude 5.5ファミリーの最初のモデルとしてClaude Opus 5.5を発表しました。同社は、大半の業務でClaude Fable 5.1と同水準の性能を示し、運用コストはOpus 5より40%低いと説明しています。この40%は、同社のテストでデフォルト設定・典型的な作業負荷の場合に見込まれる数字です。また、Amazon Web Services、Google Cloud、Microsoft Azureを含む全プラットフォームで利用できるとしています(出典: Anthropic 公式)。
「40%減」を分解する——単価、キャッシュ読取、トークン数
技術責任者として最初に確認したのは、この40%が何でできているかです。価格表では、100万トークンあたりの入力が$4(Opus 5は$5)、出力が$20(同$25)、キャッシュ読取が$0.20(同$0.50)です。同社は入出力をOpus 5より20%安く、キャッシュ読取を60%安いとし、キャッシュ読取はエージェント的な作業やコーディング作業の費用の大半を占めると説明しています(出典: Anthropic 公式)。
同社は、Opus 5.5は単価が安いだけでなく1タスクあたりの使用トークンも少なく、合わせて40%のコスト減になると述べています。下げ幅が項目ごとに違う以上、自社の費用の下がり方は、入力・出力・キャッシュ読取の構成比と1タスクの総トークン数で決まると、私たちは読みました。速度面では、出力の生成がOpus 5より30%超速いとされ、Claude CodeとClaude Platformでは最大2.5倍の速度のFast modeも使えます。Fast modeの料金は100万トークンあたり入力$8・出力$40です(出典: 同上)。
エフォート設定という変数——効率の主張は誰の言葉か
同社の測定では、複数手順の業務タスクを測るTerminal-Bench 4.0で、Opus 5.5のデフォルトのエフォートがOpus 5の最大エフォートを約5分の1の費用で上回ったとされています。Factoryは、Opus 5.5が初めてmediumエフォートを既定にしたいモデルだと評し、自社テストでhighエフォートのOpus 5と同等で、出力トークンが20〜25%少なかったと述べています(出典: Anthropic 公式)。
いずれも発表元の測定、または各社が自社環境で行った評価です。同社自身も、この水準ではベンチマークの差は現実の差の指標として信頼しにくくなっていると述べ、自社での利用ではOpus 5.5とFable 5.1の差は表のスコアより小さいと説明しています(出典: 同上)。
処理が別モデルに回る前提と、自律実行の安全面
セキュリティ上の注意点を先に述べます。Opus 5.5は、サイバーセキュリティ、生物学、蒸留(distillation)の3分野でFable 5.1と同種のセーフガードを備えて提供される初のOpusモデルで、いずれも別のモデルへ透過的に切り替わると同社は説明しています。サイバーセキュリティでは、通常のソフトウェア開発の一部としてのバグの特定・修正はできる一方、大半のサイバーセキュリティ作業はOpus 4.8に振り替えられるとしています(出典: Anthropic 公式)。
ベンチマークは本番用のセーフガードを有効にして評価され、介入時はサイバーセキュリティの課題をOpus 4.8が、生物学とフロンティアLLM開発の課題をOpus 5が処理しました。同社はこれがスコアを下げている可能性が高いとしています(出典: 同上)。プロンプトインジェクションについて同社は、テストした全設定でOpus 5と同等以上で、Gray Swanが実施したベンチマークではテストされた全モデルの中で最も低い成功率でFable 5.1と並んだと述べています。ただし、デプロイ前にあらゆる失敗を確実に捉える評価の構築は未解決の問題だとも書いています(出典: 同上)。
中小企業への翻訳——自社の1業務で測る
- 単価表ではなく、同じ業務1件の総費用で比べる。 入力・出力・キャッシュ読取の量を記録してください。
- エフォートごとに品質と費用を測る。 発表資料の数字をそのまま自社に当てはめないでください。
- セキュリティ関連の作業は別モデルで処理され得る前提で、用途と処理モデルの対応を確認する。
- 長時間の自律実行は、権限を最小にし、実行環境を分ける。 モデル側の安全性評価に頼り切らないでください。
まとめ
- Anthropicは2026年9月22日にClaude Opus 5.5を発表。運用コストはOpus 5より40%低い(デフォルト設定・典型的な作業負荷での同社テスト)と説明している
- 100万トークンあたり入力$4・出力$20はOpus 5より20%安く、キャッシュ読取$0.20は60%安い。出力の生成はOpus 5より30%超速い。Fast modeは最大2.5倍の速度
- Terminal-Bench 4.0では、デフォルトのエフォートがOpus 5の最大エフォートを約5分の1の費用で上回ったと同社は述べる。一方で、ベンチマークの差は現実の差の指標として信頼しにくくなっているとも述べる
- サイバーセキュリティ・生物学・蒸留の3分野でセーフガードが働き、サイバー関連の大半の作業はOpus 4.8に振り替えられる。同社はあらゆる失敗を確実に捉える評価の構築を未解決の問題だとも書いている
価格表の差を並べても、請求書は予測できません。単価、キャッシュ読取、使用トークン数、エフォート設定、処理が別モデルへ回る範囲。これらを自社の1業務で測って初めて、上位モデルを選ぶか下位モデルで足りるかを判断できると私たちは考えます。
※ 本記事は一般的な情報提供を目的としており、個別の法的・財務的・経営的助言ではありません。具体的な課題については専門家にご相談ください。