Amazon Web Servicesは2026年8月20日、Amazon Bedrock上でOpenAIのGPT-5.6モデルを提供開始した。最大3種類の変種がサポートされ、リクエストを複数のAWSリージョン間で分散するクロスリージョン推論機能に対応している。
GPT-5.6モデルの提供と対応機能
Amazon Bedrockは現在、25以上のAWSリージョンでOpenAI GPT-5.6モデルを提供しています。この発表では、Sol、Terra、Lunaという3種類の変種がクロスリージョン推論に対応するとされています。これら3つは用途ごとに能力とコストのバランスを調整したものです。すべてテキストや画像を入力として受け取り、テキストで応答します。100万トークンのコンテキストウィンドウを持ち、推論モードやサーバーサイドツール呼び出し、プロンプトキャッシングにも対応しています。
クロスリージョン推論の仕組み
Amazon Bedrockでのクロスリージョン推論は、「推論プロファイル」を通じて動作します。これは特定のモデルと、リクエストをルーティング可能なAWSリージョンの組み合わせを定義するものです。ソースリージョンから呼び出されたリクエストは、指定された宛先リージョンの計算資源を使用して処理されます。
この機能は主に容量確保のための仕組みです。単一のリージョンに縛られず、より広い計算資源のプールを活用することで、スループットの向上と負荷時のパフォーマンス維持を目指します。データ residency(所在地要件)が求められる場合は地理的なプロファイルを使い、そうでない場合はグローバルプロファイルで全対応リージョンからリアルタイム容量に基づいてルーティングされます。
利用方法と注意点
GPT-5.6はOpenAI Responses API、Chat Completions API、Amazon Bedrock Converse APIを介して呼び出すことができます。推論プロファイルは生モデルIDの代わりに使用します。地理的プロファイルは特定の地理領域内に処理を留める一方、グローバルプロファイルは世界中の商業リージョンにリクエストを分散させます。課金とクォータ消費はアカウント単位で追跡されるため、バックエンドのリージョンがどこであっても一元的な管理が可能です。ただしデータ所在地要件がある場合はグローバルプロファイルではなく地理的プロファイルや直接呼び出しを選ぶ必要があります。
