OpenAIは、限定プレビューを経てGPT‑5.6ファミリーの一般提供を開始しました。新たなフラッグシップのSolに加え、日常業務向けにバランスを取ったTerra、最もコスト効率の高いLunaを展開します。Solは知能と効率性で新標準を打ち立て、コーディング、知的作業、サイバーセキュリティ、科学の各分野で従来モデルや競合フロンティアモデルを上回る性能を示します。少ないトークンと低い推定コストで高い成果を出せるため、同じ支出で成果を拡大するか、総コストを下げて同等の結果を得る運用が可能になります。さらに、複数エージェントを並列連携させるultra設定を導入し、負荷の高いタスクをより短時間で完了できるようにしました。
パフォーマンスと効率の到達点
GPT‑5.6 Solは、長時間実行のプロフェッショナルワークフローを測るAgents’ Last Examで53.6の高値を記録し、Claude Fable 5に対し13.1ポイント上回る結果を示しました。中程度の推論条件でも推定コストは約4分の1で、Fable 5を11.4ポイント上回るとされています。TerraとLunaも効率性が強みで、約16分の1のコストでFable 5を上回ると説明されています。Artificial Analysis Intelligence Indexでは、max推論を用いたSolがタスク所要時間を61パーセント短縮し、推定コストを約半減させながらFable 5に1ポイント以内まで迫る結果が示されました。いずれの数値も、少ないトークンと短いレイテンシで高品質な応答を実現する設計思想を裏付けています。企業は同一予算内で処理規模の拡大や応答速度の向上を見込める構成です。コスト最適化を優先する利用では、TerraやLunaの選択肢が広がることになります。
コーディングとツール連携の強化
コーディング領域では、Artificial Analysis Coding Agent IndexでSolが80を記録し、新たな最先端水準に到達しました。Fable 5を2.8ポイント上回り、出力トークンと所要時間をいずれも半分未満、推定コストを約3分の1に抑える効率を示します。TerraはFable 5をわずかに上回り、LunaはOpus 4.8を上回る結果とされます。Terminal-Bench 2.1やDeepSWEでも高水準を達成し、長期的なエンジニアリング作業への適性を示しました。加えて、GPT‑5.6はツールを連携させて中間結果を処理し、進捗に応じて次のアクションを選択する軽量プログラムを生成・実行できます。Responses APIのProgrammatic Tool Callingにより、中間データの取捨選択やワークフロー調整が可能になり、ツール往復の回数やガイダンスを削減できます。さらにmaxは推論時間を拡張し、ultraはデフォルトで4エージェントを並列実行して品質と時間短縮の両立を図ります。APIではマルチエージェントのベータ提供により、Ultraに類似する体験を構築できます。
デザインとナレッジワークの進歩
GPT‑5.6はデザイン判断に進歩があり、少ない指示から洗練され使いやすいインターフェースを作成できます。コンピューター操作の強化で、生成だけでなくレンダリング結果を確認して調整するため、視覚や機能の問題を検出して仕上げられます。ナレッジワークでは、BrowseCompで92.2パーセント、OSWorld 2.0で62.6パーセントの結果が示され、トークン使用の抑制と性能向上を両立しています。プレゼンテーションやドキュメント、スプレッドシートの品質も向上し、レイアウトや情報階層、タイポグラフィに整合した一貫性のある成果物を生成します。テンプレートや参照ファイルに忠実なスタイル適用が可能で、マスタースライドのルールを含めたデザインシステムを把握し、再現性の高い資料作成に貢献します。数式や財務モデルの取り扱いも改善しており、編集可能な成果物としての実用性が高まっています。
サイバーセキュリティと科学分野の到達点
サイバー領域では、ExploitBenchやExploitGym、SEC-Bench ProなどでGPT‑5.6の向上が示されています。使用トークンを抑えつつフロンティアレベルの性能に達し、コードレビューやパッチ適用、脅威モデリング、ブルーチーム活動を支援できるとされています。Trusted Access for Cyberプログラムの対象者は、防御的なタスクに対して精密なセーフガードの下でより多くの機能にアクセスできます。科学では、GeneBench ProやLifeSciBench、MedChemBenchなどで、より少ないトークンと短い時間での性能向上が確認され、GPT‑5.5に対するパレート改善が示されました。これらの結果は、知識集約的な作業における効率の向上と、成果物の質的な改善に直結します。業務の計算資源配分を最適化しながら、高度な検証や分析を短時間で反復する基盤が整います。
安全対策と提供形態、価格
GPT‑5.6は、執拗かつ適応的な悪用に対して回復力を備えつつ、正当な作業を過度に制限しない安全対策を多層で構築しています。人手によるレッドチーミングと大規模な自動テストを組み合わせ、リアルタイムチェックや監視、リスクに応じたアクセス制御を重ねる設計です。防御目的の作業を妨げないよう推論モニターを追加し、最もセンシティブな機能はTrusted Access経由で確認済みユーザーに限定します。提供はChatGPT、Codex、APIで本日から開始し、24時間以内の完全提供を目指します。チャットではPlus、Pro、Business、EnterpriseがSolを中程度以上の推論で利用可能で、ProとEnterpriseはSol Proも選択できます。ChatGPT WorkとCodexでは、無料およびGoはTerra、Plus以上はSol、Terra、Lunaから選択でき、maxは全ユーザー、ultraはWorkのProとEnterprise、CodexはPlus以上で利用できます。APIではSol、Terra、Lunaへアクセスでき、Programmatic Tool Callingやマルチエージェントのベータを提供します。価格は100万トークンあたりで、Solが入力5ドルと出力30ドル、Terraが入力2.5ドルと出力15ドル、Lunaが入力1ドルと出力6ドルです。明示的キャッシュブレークポイントの導入や最低30分のキャッシュ有効期間など、予測可能なキャッシュ課金も加わりました。
詳しくは「OpenAI」の公式ページまで。レポート/DXマガジン編集部






















