Amazon Bedrock で OpenAI GPT-5.6 Sol、Terra、Luna を使い始める
OpenAI GPT-5.6 Sol、Terra、Luna が Amazon Bedrock で一般提供を開始しました。モデルの選択方法、bedrock-mantle エンドポイント上の Responses API を使用した推論、プロンプトキャッシングによるコスト削減、OpenAI Codex コーディングエージェントの接続、クォータとスケーリングの計画について学びます。
OpenAI GPT-5.6 シリーズモデル——Sol、Terra、Luna——が Amazon Bedrock 上で一般提供を開始しました。開発者は、個別のモデルインフラを運用することなく、使い慣れた OpenAI Responses API を通じてこれらの最先端モデルを呼び出すことができます。これら3つのモデルは、自律コーディングエージェントや長期間の推論から、高スループットでレイテンシーに敏感な推論まで、さまざまなワークロードをカバーし、AWS のセキュリティ、リージョナル処理、コスト管理機能を備えています。
すべてのモデルは、bedrock-mantle エンドポイント上の Responses API を通じてアクセスします。Sol は旗艦推論モデルであり、Terra は日常のプロダクション作業に適したパフォーマンスとコストのバランスを提供し、Luna は高速で低コストの推論に最適化されています。価格は OpenAI のファーストパーティー価格と同様で、使用量は既存の AWS コミットメントにカウントされます。
モデル仕様概要:Sol は自律コーディング、セキュリティ研究、科学分析、深い多段階推論に最適で、米国東部(バージニア北部)およびオハイオリージョンで利用可能です。Terra は汎用プロダクションワークロードに対応し、上記リージョンに加えて米国西部(オレゴン)でも利用できます。Luna は分類、要約、ルーティングなどの高スループット・低レイテンシー向けで、Terra と同じリージョンで利用可能です。すべてのモデルはテキストおよび画像入力、テキスト出力、272K トークンのコンテキストウィンドウ、none から max までの推論努力レベルをサポートしています。
開始するには、bedrock-mantle エンドポイントに対する推論権限を持つ AWS アカウントが必要です。AmazonBedrockMantleInferenceAccess 管理ポリシーを IAM プリンシパルにアタッチすることを推奨します。OpenAI Python SDK 2.45.0 以降をインストールし、自動更新される短期キーまたは環境変数を使用して認証します。自動更新方式では BedrockOpenAI クライアントとトークンプロバイダーを使用し、環境変数方式では AWS_BEARER_TOKEN_BEDROCK を設定して手動で渡します。
初回推論を実行するには、モデル ID(例:openai.gpt-5.6-terra)、入力、最大出力トークン数を指定して Responses API を呼び出すだけです。推論努力を制御するには、reasoning.effort パラメータを設定します。例えば、複雑な数学問題には high を選択するとより正確な結果が得られます。
ツール呼び出しは GPT-5.6 の主要機能です。モデルの出力に含まれる推論項目を次の入力に含め、クライアント側で関数呼び出しループを実装します。これにより、モデルが外部データを要求し、多段階タスクを完了できるようになります。本番環境では Amazon Bedrock Guardrails の使用をお勧めします。
コンソールエクスペリエンスは次世代推論エンジン向けに最適化されています。プロジェクトを作成し、モデルを割り当て、API キーを構成し、モデルを並べて評価できます。モデルカタログでは、GPT、Claude、オープンウェイトモデルを含む最大3つのモデルを同時に比較できます。
プロンプトキャッシングはコスト削減の鍵です。暗黙的キャッシュはデフォルトで有効で、コード変更は不要です。明示的キャッシュでは、キャッシュブレークポイントを使用してキャッシュする部分を正確に制御します。キャッシュされた入力は90%割引され、キャッシュへの書き込みは1.25倍で課金されます。各ブレークポイントには少なくとも1024トークンのプレフィックスが必要で、リクエストあたり最大4つのチェックポイントを設定できます。キャッシュは最低30分間保持されます。一貫した prompt_cache_key を設定すると、マッチの信頼性が向上します。例えば、システム指示をキャッシュし、ユーザーの質問をブレークポイントの後に配置することで、繰り返しリクエストのコストを大幅に削減できます。
以上、GPT-5.6 シリーズは Amazon Bedrock 上で、AWS のセキュリティとスケーラビリティを活用しながら、複雑な推論から高スループットの本番環境まで、多様なニーズに応える強力な AI 機能を提供します。