Anthropicは、最新モデル「Opus 5.5」において、従来モデルのOpus 5よりもトークンあたりのコストが低くなると発表しました。モデルの価格改定に加え、タスクの完了方法やコスト構造に関する詳細な情報を公開しています。
コスト構造の変化と価格改定
Opus 5.5では、すべての価格項目がOpus 5と比較して引き下げられています。入力および出力トークンの価格は20%安くなり、キャッシュ読み取りの価格は60%安くなりました。キャッシュ読み取りの価格は、入力価格の10分の1から20分の1へと低下しています。
API利用において、キャッシュ読み取りのコスト低下はClaude Codeなどの長期的なセッションで特に大きな影響を与えます。一方、Pro、Max、Teamプランのユーザーに対しては、Opus 5.5の低い価格設定が利用制限にも反映され、キャッシュされたコンテキストを含め、Opus 5よりも約25%長く利用できるとしています。
タスクのコストを左右する要素
モデルがタスクを完了するまでのコストは、主に4つの要素によって決まります。1つ目は、会話の履歴を再送するたびに発生する「ターン数」です。2つ目は、再送されるテキストの多くをカバーする「キャッシュ読み取り」です。3つ目は、入力価格の5倍のコストがかかる「出力トークン」で、これにはモデルの「思考」プロセスも含まれます。最後に、選択する「モデル」自体の単価が影響します。
効率的なタスク実行のために
Opus 5.5では、モデルが回答の前に常に思考を行うため、Opus 5よりも多くのトークンを使用する場合があります。しかし、モデルが自身の作業をチェックするためのテストやスクリプトを実行できるようにすることで、ターン数を減らし、結果としてコストを抑えられるとしています。
また、Opus 5.5は長い実行の最後に、変更内容や発見したこと、必要なアクションをまとめたレポートを作成します。これにより、セッションをやり直す回数を減らすことが可能になると説明しています。さらに、モデルの取り組み方(effort)を制御する4つのレベル(low、medium、high、xhigh)が用意されています。
