OpenAI / ChatGPT / Codex のロゴ

OpenAI / ChatGPT / Codex / 公式ブログ / 2026/06/26 / 重要

GPT-5.6 Sol プレビューと安全策

AI

公式ブログ原文

OpenAI は 2026年6月26日、GPT-5.6 シリーズの限定プレビューを発表しました。最上位の Sol、日常業務向けの Terra、低コスト寄りの Luna という構成で、能力向上と安全策、段階的な提供を同時に説明しています。

要点

  • GPT-5.6 Sol は限定プレビューとして開始され、Terra と Luna も同じシリーズの選択肢として示されました。
  • Sol には深い推論のための max 推論努力設定と、複数のサブエージェントを使う ultra モードが導入されます。
  • OpenAI は、コーディング、生物学、サイバーセキュリティの評価で能力向上を示しつつ、サイバー悪用への多層的な安全策を強調しています。
  • API と Codex で一部の信頼済み組織から始まり、ChatGPT、Codex、API への広い提供は今後に予定されています。

今回のブログ記事で語られていること

今回の OpenAI の発表は、GPT-5.6 シリーズを単なる新モデル名として出すのではなく、能力層、提供範囲、安全策、価格の考え方をまとめて示すものです。シリーズ内では Sol が最上位モデル、Terra が日常業務に向くバランス型、Luna が速さと低コストを重視するモデルとして説明されています。Terra は GPT-5.5 に近い性能をより低い価格で提供し、Luna は最も低いコスト帯で強い能力を持つ選択肢として位置づけられています。

能力面では、Sol が現時点で最も強いモデルだと説明されています。OpenAI は、コーディング、生物学、サイバーセキュリティに関する評価を示し、特に長い手順、ツール連携、反復を伴う作業での改善を強調しています。新しい max 推論努力設定は Sol により深く考える時間を与える設定で、ultra モードは単一のエージェントを超えてサブエージェントを活用する仕組みとして説明されています。開発チームにとっては、単発の回答品質だけでなく、長いタスクをどう分割し、どこまでAIに任せられるかが焦点になります。

同時に、発表はサイバー能力の上昇をかなり慎重に扱っています。OpenAI は、GPT-5.6 Sol が脆弱性の発見や修正を支援する能力を高める一方で、禁止される攻撃支援を難しくし、検出しやすくする安全策を組み合わせると説明しています。モデル自体の拒否、生成中の分類器、より大きな推論モデルによる確認、アカウント単位のリスク確認、段階的なアクセス制御を重ねる考え方です。ベンチマーク上では Cyber Critical のしきい値を超えないとされていますが、現実の使われ方は評価だけでは完全に表せないため、段階的な公開と継続テストを組み合わせています。

提供面では、GPT-5.6 はまず API と Codex で一部の信頼済みパートナーや組織に限定されます。OpenAI は、米国政府とのやり取りの一環として計画と能力を事前に共有したこと、ただしこのような政府アクセス手続きが長期的な標準になるべきではないとも述べています。価格は 100万トークンあたりで Sol、Terra、Luna に分かれ、明示的なキャッシュ区切りや30分の最小キャッシュ寿命も導入されます。読者にとっては、モデル選択、リスク評価、キャッシュ設計、限定提供時の検証計画をまとめて見る必要がある発表です。

背景にあるテーマ

モデルの能力が上がるほど、単純な性能比較だけでは導入判断ができません。特にサイバー、コーディング、生物学のように二重用途になりやすい領域では、利用できるチーム、アクセス条件、監視、拒否、評価、価格が一体で設計されます。GPT-5.6 Sol の発表は、高性能モデルを広く出す前に、どの段階で誰が何を検証するかを明示する事例です。

今回のブログ記事が関係する人

OpenAI API を使う開発者、Codex を業務に組み込む開発組織、AIセキュリティ担当、モデル評価担当、研究開発部門、AIプロダクトの責任者に関係します。特に、長い推論、複数エージェント、脆弱性調査、バイオ系分析に関わるチームは注意して読む必要があります。

どう読むと価値があるか

この発表は、GPT-5.6 Sol をすぐ一般利用できる新モデルとして読むより、限定プレビューで何を検証すべきかを示す文書として読むほうが実務的です。評価値や価格だけでなく、どのユースケースが限定アクセスの対象になり、どの安全策が働き、どのログやアカウント単位の確認が入るのかを見たいです。max 推論努力設定や ultra モードは魅力的ですが、利用側はコスト、レイテンシ、失敗時の制御、監査可能性を同時に検討する必要があります。

実務へのつながり

導入を検討するチームは、まず GPT-5.6 を試す候補業務を分けるとよいです。高速な日常処理、長いコーディング支援、セキュリティ検証、バイオ分析、複数エージェントの作業では、評価指標が異なります。価格とキャッシュの変更も、長文入力や繰り返しプロンプトを使うシステムに影響します。限定プレビューの段階では、本番投入よりも、評価データ、権限設計、安全レビュー、コスト試算を整えることが先になります。

結局、今回のブログ記事をどう読むべきか

GPT-5.6 Sol の発表は、能力向上だけでなく、提供方法と安全策を含めたモデル運用の発表です。開発者や管理者は、Sol、Terra、Luna の役割、限定提供の意味、max / ultra の運用条件、キャッシュと価格、安全策の境界を分けて確認したいです。すぐに全利用者へ開放される話ではないため、現時点では検証計画と利用ガバナンスを準備する発表として読むのが妥当です。