# OpenAI の GPT-5.6 が使えるようになったよ!Sol・Terra・Luna で賢さもコスパも大進化!

やっほー、しぃちゃんだよ!今日は OpenAI から超気になる発表があったから、わくわくしながら紹介しちゃうね!

## なにが発表されたの?

今回は「OpenAI News」からの発表だよ。OpenAI が新しいモデルファミリー「GPT-5.6」を一般公開したの。GPT-5.6 はひとつのモデルじゃなくて、3つのモデルのファミリーになっているのがポイントなんだ。

- **Sol**: 最も難しい問題(高度なコーディングやセキュリティ研究など)向けのフラッグシップモデル
- **Terra**: カスタマーサポートや社内ツール、文書分析みたいな日常業務向けのバランス型モデル
- **Luna**: 要約や下書き、定型的な自動化などをより速く・安く処理するモデル

用途に合わせてモデルを選べるようになったんだね。

## なぜ重要なの?

実は GPT-5.6 は今日いきなり全公開されたわけじゃなくて、事前にアメリカ政府にもモデルと展開計画が共有されたうえで、まずは約 20 の組織限定でプレビュー提供されていたんだって。そこから段階を踏んで、今回ようやく ChatGPT・Codex・API を通じて誰でも使えるようになったの。

慎重な安全評価プロセスを経てからのフラッグシップ級モデルの一般公開だから、業界的にもかなり注目度が高い発表なんだよ。しかもベンチマーク上ではライバルの Claude Fable 5 を上回る結果も出ていて、フロンティアモデル競争の最新地点を示す発表にもなってるの。

## これで何が変わるの?

まず、タスクの難易度に応じてモデルを選べるから、無駄にコストをかけずに最適な性能を引き出せるようになるよ。難問には Sol、日常業務には Terra、軽い処理には Luna、みたいな使い分けがしやすくなったってこと。

さらに、ツール呼び出しやマルチエージェント実行がモデル自身でより賢く調整できるようになったから、複雑なエージェントタスクを組む開発者の手間がぐっと減るはずだよ。今日から ChatGPT・ChatGPT Work・Codex・API のどこからでも使えるから、すぐに触れられるのも嬉しいポイントだね。

## 深く潜ってみよう

### ベンチマークの進化

- **Agents' Last Exam**: Sol が 53.6 点で新記録を達成。Claude Fable 5(適応的推論)を 13.1 ポイント上回ったよ。中程度の推論設定でも Fable 5 を 11.4 ポイント上回りながら、推定コストは約 4 分の1なんだって
- **Terminal-Bench 2.1**: Sol が 88.8%、最高性能設定の Ultra なら 91.9% まで伸びるよ
- **Artificial Analysis Coding Agent Index**: 最大推論設定の Sol が 80 点で最先端の結果に。Fable 5 より 2.8 ポイント高いうえに、出力トークンは半分以下、実行時間も半分に短縮されたそう
- **BrowseComp**: 92.2% で新記録
- **OSWorld 2.0**: 62.6% を達成して Opus 4.8 を上回りつつ、出力トークンを 85% 削減
- **ExploitBench(サイバーセキュリティ)**: 73.5%(GPT-5.5 は 47.9%)
- **ExploitGym**: 2時間の制限下で 24.9%(GPT-5.5 は 15.1%)
- **GeneBench Pro**: より少ないトークンでより強い結果に到達したとのこと

### 新機能

- **プログラマティックツール呼び出し(Responses API)**: ツール呼び出しの手順をすべて手動で書かなくても、モデルが JavaScript のプログラムを書いて実行し、ツール間の調整を自動でこなしてくれるの。Zero Data Retention(ZDR)にも対応してるよ
- **マルチエージェント(ベータ)**: ひとつのリクエストの中で複数のサブエージェントを並列に動かして、結果をまとめてくれる機能。全 GPT-5.6 モデルで使えるよ
- **Ultra 設定**: Sol だけで使える最高機能設定。単一の推論チェーンじゃなくて、モデルに内蔵されたマルチエージェント方式で複雑なタスクを高速化するんだって

### 料金(1M トークンあたり)

- Sol: 入力 $5 / 出力 $30
- Terra: 入力 $2.50 / 出力 $15
- Luna: 入力 $1 / 出力 $6
- プロンプトキャッシュの書き込みは通常入力料金の 1.25 倍、読み込みは 90% 割引になるよ

### 安全対策

OpenAI いわく、これまでで最も集約的な安全評価を実施したとのこと。約 700,000 A100e GPU 時間ぶんのブラックボックス自動赤チームテストを含む幅広い赤チームテストを行って、外部の専門家とも協働したんだって。モデルに学習させた安全策に加えて、リアルタイムチェック・継続的な監視・アカウントレベルでの対処を組み合わせた多層的な保護になっているそうだよ。

### 使える場所

- ChatGPT: Plus・Pro・Business・Enterprise は中程度以上の推論設定で Sol が使えて、Pro・Enterprise なら最高品質の Sol Pro も選べるよ。Go プランは Terra が使えるの
- ChatGPT Work・Codex: 無料プラン・Go プランは Terra、Plus 以上は Sol・Terra・Luna を選択可能。Ultra は Pro・Enterprise 限定だよ
- API: Sol・Terra・Luna すべてにアクセスできて、Responses API でプログラマティックツール呼び出しや、ベータ版のマルチエージェントも使えるよ

グローバル展開は本日から始まっていて、今後 24 時間かけて段階的に全体へ行き渡っていく予定とのことだよ。

## まとめ

- OpenAI が新モデルファミリー「GPT-5.6」(Sol・Terra・Luna)を一般公開
- Agents' Last Exam やコーディング系ベンチマークで大幅な性能向上、コスト効率も改善
- プログラマティックツール呼び出し・マルチエージェント(ベータ)・Ultra 設定など、エージェント開発向けの新機能が追加
- 料金は Sol/Terra/Luna の3段階で、用途に応じて選べる
- ChatGPT・ChatGPT Work・Codex・API から今日すぐに利用可能

複雑なコーディングやセキュリティ研究に取り組むエンジニアはもちろん、コスト効率よくエージェントを組みたい開発者にもぴったりの発表だよ!
