OpenAIは2026年6月26日、3層構成の新モデルファミリーGPT 5.6 Sol(旗艦モデル)、Terra(バランス型・低コスト)、Luna(最速・最安)を発表。 コーディングベンチマークTerminal Bench 2.1でSol Ultraが91.9%を達成し、AnthropicのClaude Mythos 5(88.0%)を上回る新記録。
研究の答え

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What are the key details about OpenAI's preview of the GPT-5.6 family (Sol, Terra, and Luna), inc. Article summary: Here is a verified, sourced summary of the key details about OpenAI's GPT-5.6 family preview, announced June 26, 2026.. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fake numbers, clickbait thumbnails, icons, and tiny thumbnail layouts. Make it useful as an illustrative
2026年6月26日、OpenAIはGPT-5.6ファミリーを発表し、Sol、Terra、Lunaという3つの新モデルを公開しました。この発表が注目を集めたのは、モデルの性能向上だけでなく、米国政府との協調による前例のない公開制限が伴った点にあります。本記事では、新しい命名体系、コーディング・生物学・サイバーセキュリティのベンチマーク結果、多層的な安全スタック、料金体系、プロンプトキャッシュのアップデート、そして段階的な公開アプローチまで、すべての重要な詳細を解説します。
OpenAIは今回のリリースで新しい命名規則を採用しました。世代番号「5.6」がモデルシリーズを示し、Sol、Terra、Lunaという名称が能力階層を表します。このシステムは長期的な使用を想定して設計されており、Sol、Terra、Lunaはそれぞれ独自のペースで進化していきます。3つの階層は以下の通りです。
OpenAIはGPT-5.6 Solを、コーディング、生物学、サイバーセキュリティの3つの主要分野で新たな最前線に位置づけています。
Terminal-Bench 2.1は、複数ステップの計画、ツールの連携、反復処理を必要とするコマンドライン作業をテストするベンチマークです。89の複雑なプログラミングタスクで構成されています
。結果は以下の通りです。
| モデル | スコア |
|---|---|
| GPT-5.6 Sol Ultra | 91.9% |
| GPT-5.6 Sol(最大) | 88.8% |
| Claude Mythos 5 | 88.0% |
| GPT-5.6 Terra | 84.3% |
| Claude Fable 5 | 84.3% |
| GPT-5.5 | 83.4% |
| GPT-5.6 Luna | 82.5% |
GPT-5.6 Sol Ultraは91.9%で新たな最高記録(State of the Art)を達成しました。標準のSolスコア88.8%は、Anthropicの制限付き最前線モデルであるClaude Mythos 5の88.0%を約1ポイント上回っています
。
GeneBench v1は、長期的なゲノミクス(遺伝子解析)や定量生物学の分析タスクを評価するベンチマークです。OpenAIは、SolがGPT-5.5よりも少ない出力トークンでより強力な結果を達成したと報告しています。これは科学研究のワークフローにおいて、意味のある効率改善を示しています。
サイバーセキュリティ研究ベンチマークの ExploitBench では、GPT-5.6 SolがAnthropicのMythos Previewとほぼ同等の性能を示しながら、出力トークンは約3分の1に抑えられました。
ExploitGym は、UCバークレーの研究者がOpenAIや他の最前線AIラボと協力して構築したベンチマークです。このテストでは、GPT-5.6の全3モデルにおいて、推論能力の向上に伴いサイバーセキュリティ性能が改善されました。
重要なのは、OpenAIがGPT-5.6 Solは自社のPreparedness Framework(準備態勢フレームワーク)のもとでCyber Critical(サイバー重大)閾値を超えていないと明言している点です。ChromiumやFirefoxを対象とした評価では、モデルはバグやエクスプロイトの構成要素を特定しましたが、テスト条件下で自律的に機能する完全なエクスプロイトチェーンを生成することはありませんでした
。GPT-5.6シリーズ全体として、内部評価では(サイバーセキュリティと生物兵器能力の次元で)「High(高)」リスクと評価されましたが、最高レベルの「Critical(重大)」には達していません
。
OpenAIは、GPT-5.6 Solが「これまでで最も堅牢な安全スタック」とともにローンチされると述べています。安全対策には以下が含まれます。
プレビュー期間中は、OpenAIが誤検出率と検出漏れ率を微調整するため、一部のプロンプトが追加審査のために遅延またはブロックされる可能性があります。
GPT-5.6の展開は、これまでのOpenAIのリリースとは一線を画すものです。米国政府の要請により、OpenAIは当初、少数の信頼できるパートナーと組織(Axiosの報道によれば約20社)にのみアクセスを制限し、モデルは追加の国家安全保障審査を受けることになりました。
このプレビューは、広くセルフサービスで利用できるプログラムではありません。この期間中、GPT-5.6 Sol、Terra、Lunaは、この限定されたグループに対してのみOpenAI APIとCodexを通じて利用可能です。プレビュー期間中、これらのモデルはChatGPTでは利用できません
。OpenAIは、ChatGPT、Codex、APIでの広範な提供を「数週間以内」に計画していると述べています
。
OpenAIは、政府による承認プロセスを一時的なものと明確に位置づけています。同社は「我々は広範なアクセスを信じており、このプロセスが長期的なデフォルトとなるべきではない」と明言しました。内部メモの中で、CEOのサム・アルトマンはスタッフに対し、政府が「このプレビュー期間中、顧客を一社ごとに承認する」とし、数週間後にはより広範なリリースを期待していると伝えています
。
このプロセスは、米国国家サイバー局長室(Office of the National Cyber Director)および科学技術政策局(Office of Science and Technology Policy)との協議から生まれたものであり、トランプ政権が試験的に導入している新たな最前線モデル枠組みを反映しています
。
OpenAIの公式ヘルプセンターは、100万トークンあたりの以下の料金を確認しています:
| モデル | 入力 / 100万トークン | 出力 / 100万トークン |
|---|---|---|
| GPT-5.6 Sol | $5.00 | $30.00 |
| GPT-5.6 Terra | $2.50 | $15.00 |
| GPT-5.6 Luna | $1.00 | $6.00 |
Solの価格はGPT-5.5と同額ですが、TerraはGPT-5.5と比較して約2倍安価です。参考までに、Solの価格はAnthropicの制限付きモデルMythos 5($10/$50)よりも、Claude Opus 4.8($5/$25)に近い設定となっています
。
GPT-5.6では、より予測可能なプロンプトキャッシュが導入され、いくつかの重要な変更点があります:
OpenAIはまた、GPT-5.6 Solが7月にCerebrasハードウェア上で展開されることを発表しました。推論速度は最大750トークン/秒に達します
。
GPT-5.6ファミリーは、これまでのOpenAIのローンチから大きく逸脱した発表となりました。3層構造(Sol、Terra、Luna)は、モデルシリーズと能力階層を切り離す、長期間使用可能なブランディングを導入しています。ベンチマークの結果、特にTerminal-Bench 2.1でのSolの最高記録とExploitBenchでの効率改善は、サイバーセキュリティや生物学の分野で意味のある進歩を示しています。しかし、今回のローンチを最も特徴づけるのは、政府によるアクセス制限であり、これは最前線AIの展開における新たなパラダイムを象徴しています。
Studio Global AI
このページにはソースに裏付けされた回答が含まれており、Studio Global 内で続行できます。
OpenAIは2026年6月26日、3層構成の新モデルファミリーGPT 5.6 Sol(旗艦モデル)、Terra(バランス型・低コスト)、Luna(最速・最安)を発表。
OpenAIは2026年6月26日、3層構成の新モデルファミリーGPT 5.6 Sol(旗艦モデル)、Terra(バランス型・低コスト)、Luna(最速・最安)を発表。 コーディングベンチマークTerminal Bench 2.1でSol Ultraが91.9%を達成し、AnthropicのClaude Mythos 5(88.0%)を上回る新記録。
生物学(GeneBench v1)では少ない出力トークンでGPT 5.5超え、サイバーセキュリティ(ExploitBench)ではMythos Previewと同等の性能を約1/3のトークンで実現。