CodeRabbitは2026年9月22日に、新しいモデル「Opus 5.5」に関する評価結果を発表しました。同モデルはコーディングタスクにおける性能向上と、トークン単価の引き下げを同時に実現しています。
コーディング性能の向上とコストの低減
Opus 5.5は、多段階のコーディングタスクにおいて、Opus 5の「高負荷(high effort)」設定と同等以上の性能を、「中負荷(medium effort)」設定で発揮します。この際、消費されるトークン量は約半分に抑えられています。また、コスト面でも改善が見られ、入力トークンは100万トークンあたり5ドルから4ドルに、出力トークンは25ドルから20ドルへと、それぞれ20%の値下げが行われました。キャッシュ読み取りの料金も100万トークンあたり0.20ドルへと60%削減されています。
バグ検出における新たな特性
CodeRabbitの検証 pipelineを用いた評価では、Opus 5.5は従来のモデルとは異なる種類のバグを検出することが示されました。例えば、データベースの更新における競合状態(レースコンディション)を特定し、アトミックなインクリメントによる修正案を提示するといった、具体的な正確性の問題の検出に成功しています。ただし、モデルによって検出できるバグの組み合わせが異なるため、既存のレビュー環境からの置き換えにあたっては、どのようなバグが新たに検出され、逆にどのようなバグが見逃されるようになるかを比較検討することが推奨されています。
推論制御と機能の変更
推論(thinking)の制御方法も変更されました。Opus 5.5では、推論の有効・無効を明示的に指定することはできず、負荷設定が推論の深さ、レイテンシ、コストを制御する主な手段となります。また、特定のツール呼び出しを強制する機能が廃止されました。これにより、アプリケーション側ではツール呼び出しが行われたかどうかをチェックし、行われなかった場合の処理を実装する必要があります。一方で、高速モードの利用が可能になるなど、統合に関する新たな選択肢も提供されています。
