OpenAI GPT-5.6発表 — 米政府がアクセス審査、3モデル(Sol/Terra/Luna)の段階的リリース
OpenAIがGPT-5.6(Sol/Terra/Luna三モデル)を発表。米政府要請で段階的リリースし顧客ごとにアクセス承認。700,000 GPU時間の安全テスト、サイバー・生物化学リスクHigh判定の詳細を解説。
OpenAIがGPT-5.6を発表 — 米政府がユーザー審査、Sol/Terra/Luna三モデルの段階的リリース
2026年6月26日、OpenAIは最新のAIモデルファミリー「GPT-5.6」を発表した。今回のリリースは3つのモデル(Sol、Terra、Luna)で構成され、OpenAIの「最も強力なモデル」と位置づけられている。しかし、リリース方法が例年とは大きく異なる。米国政府の要請により、限られた信頼できるパートナーのみへの段階的リリースとなったのだ。本記事ではGPT-5.6の機能、安全対策、そして政府関与の意味を解説する。
三つのモデル構成:Sol、Terra、Luna
GPT-5.6は性能とコストの異なる3つのモデルで構成される。
- Sol(ソル):最も性能の高い旗艦モデル。複雑な推論と高度なタスクに対応
- Terra(テラ):Solより低コストで性能もわずかに低い、中位のモデル
- Luna(ルナ):最も高速でコスト効率の良いモデル
OpenAIはSolを「同社の最も強力なモデル」と呼び、今後数週間以内に一般提供を開始する予定だ。
米政府によるユーザー審査 — 史上初の段階的リリース
今回のリリース最大の特徴は、米国政府がユーザーアクセスを審査している点だ。OpenAIは事前に政府にGPT-5.6の能力を共有し、政府の要請で信頼できる少数のパートナーへの限定プレビューから始めることになった。
Sam Altman CEOは従業員向けに、政府がプレビュー期間中「顧客ごとにアクセスを承認」していると説明。順調に進めば数週間後に一般提供に移行する予定だ。
OpenAIはこの措置に対して不満を示しつつ、「この種の政府アクセスプロセスが長期的なデフォルトになるべきではない」と声明。一方で、ホワイトハウスと新モデルの検証・展開フレームワークを開発するため、短期的な措置として受け入れたとしている。
Anthropic Mythosとの平行 — 業界全体の新常態
今回の政府関与は、競合のAnthropicが直面した「Mythos」モデルの状況と並行している。Anthropicは強力なサイバーハッキング能力を持つMythosを当初自主的に段階リリースしたが、その後米国政府が外国人のアクセス停止を命じ、現在は公開版を完全に引き上げている。
OpenAIのケースでは、政府の要請に従いつつも不満を表明する形をとった。アクセスを受ける企業は米国拠点だが、イギリスやオーストラリアなどの「サポート対象国」にある従業員もアクセス可能。来週以降に海外パートナーの追加を予定している。
サイバーセキュリティ能力の向上と安全対策
GPT-5.6はOpenAIのリスクフレームワークで「High」能力に分類された。サイバーセキュリティと生物化学リスクの両方で高い水準だが、最上位の「Critical」には達していない。
具体的には、SolとTerraは脆弱性の発見やエクスプロイトの一部を特定できるが、自律的なエンドツーエンド攻撃の実行はできなかった。OpenAIは「GPT-5.6は脆弱性を悪用するよりも、見つけて修正する方が得意」と評価している。
安全対策として以下を実装した:
- 新規のアクティベーション分類器(Sol/Terra)が機密分野の不安全な回答を生成中に検知・介入
- 会話をスキャンし、安全境界を超える出力をリアルタイムでブロック
- 自動安全システムが個別の会話からは見えない不安全なパターンを検出
- 700,000 A100e GPU時間を投入した自動レッドチームによる脆弱性発見
信頼ベースのアクセスプログラム
OpenAIは2つの信頼アクセスプログラムを設けている:
- Trusted Access for Cyber(TAC):資格のあるセキュリティ研究者・防御者向け
- Trusted Access to Biology Research:生命科学組織向け
これらのプログラムは一般ユーザーより幅広いデュアルユース支援を許可するが、監視とドメイン固有のブロックは維持される。
監視システムの性能
OpenAIの監視システムは専門家検証済みの評価データでテストされた:
- 生物学リスク全体の再現率:94.8%
- サイバーセキュリティリスク全体の再現率:81.6%
また、自動レッドチームで発見された最も強力な汎用ジェイルブレイクは、ブロックなしで83.0%の成功率だったが、追加対策後に0%に低下した。... [truncated]