概要
GPT-5.6 Sol は、ソフトウェア開発、研究、データ分析、複雑な業務プロセスなど、 一度の応答で多くの前提を保持しながら進めるタスクのために設計されたモデルです。 目標は、単に正答率を上げることではなく、長い作業の途中で意図を見失わず、 必要に応じて検証しながら成果物まで到達することにあります。
今回のプレビューでは、最上位の Sol に加えて、効率と性能のバランスを重視した Terra、 低コストかつ大量処理に向く Luna が示されています。用途に応じてモデルを選ぶことで、 重要な推論には Sol、日常的な開発や分析には Terra、定型的な高頻度処理には Luna を使う構成が取りやすくなります。
Sol は「難しい問いに強いモデル」であると同時に、「長い仕事を最後まで整えて進めるモデル」として位置づけられています。
モデルファミリー
GPT-5.6 ファミリーは、野心的なエージェント作業に向く Sol、日常業務向けの Terra、 高ボリューム処理向けの Luna で構成されています。下の図は、各モデルの位置づけとAPI利用時の価格をまとめたものです。
深い推論、長いコード変更、複数ツールを使うエージェント型作業に向くフラッグシップモデル。
性能とコストのバランスを重視し、日常的な開発・分析・文章作成で使いやすいモデル。
高頻度の生成、分類、要約など、処理量の多いワークロードに適した軽量モデル。
性能評価
Sol の焦点は、単発のベンチマークだけでなく、ターミナル操作、コード読解、修正、検証を含む長いワークフローにあります。 TerminalBench 2.1 では、GPT-5.6 Sol Ultra が高いスコアを示し、Sol も上位の結果として表示されています。
長い作業での安定性
エージェント型タスクでは、途中の出力が正しいだけでは不十分です。依存関係の確認、実行ログの読み取り、 失敗時の修正、最終的な説明まで一貫して行えることが重要になります。Sol はこの一連の作業を想定して評価されています。
安全対策
高い能力を持つモデルでは、攻撃的なコード生成、脆弱性探索、危険な自動化などのリスクにも注意が必要です。 GPT-5.6 のプレビューでは、能力評価と安全評価を並行して示し、モデルの強さだけでなく管理可能性も確認する構成になっています。
安全性の設計では、拒否すべきリクエストを判別するだけでなく、正当なセキュリティ研究や防御目的の作業をどう支援するかも重要です。 モデルの能力が高くなるほど、文脈、権限、目的をより丁寧に扱う必要があります。
提供と価格
図版では、Sol が最も高性能なフラッグシップ、Terra が効率重視、Luna が高ボリューム向けとして整理されています。 API利用では、入力、キャッシュ入力、出力の単価が分かれているため、長いコンテキストを扱うワークロードではキャッシュの活用が重要になります。
- Sol: 入力 $5.00、キャッシュ入力 $0.50、出力 $30.00
- Terra: 入力 $2.50、キャッシュ入力 $0.25、出力 $15.00
- Luna: 入力 $1.00、キャッシュ入力 $0.10、出力 $6.00
本ページはローカル確認用の日本語HTMLです。実際の提供地域、API条件、価格、利用制限は、 必ず公式ページとプラットフォーム上の最新情報を確認してください。