OpenAI、GPT-6 Sol および Luna モデルを公開──API 価格を GPT-5.6 比で 50% 削減
OpenAI が GPT-6 系統の新モデル Sol と Luna を公開し、API 価格を GPT-5.6 比で 50% 削減したほか、プロンプトキャッシュを強化してエージェントのコストを最適化した。
リリース: 2026-09-22 · 読了 3 分記事の要約
1. 核心(What)
- OpenAI は GPT-6 Astra の廉価版としてミドルレンジの Sol と高スループット向けの Luna を公開した。
- API のトークン単価は GPT-5.6 比で 50% 削減され、Sol が $2/$10、Luna が $0.10/$0.50 per million tokens となった。
- プロンプトキャッシュ機能が改良され、実行途中の推論 effort 変更やツール有効化・無効化を行っても既存のキャッシュが無効化されない仕様に変更された。
- Sol は Codex、ChatGPT Work、API において gpt-6-sol および gpt-6-luna として即日利用可能となっている。
2. 影響(Why)
- エージェント開発のコスト構造を転換: 長文脈のシステムプロンプトやツール定義を繰り返し送信する自律エージェントにおいて、キャッシュ効率の向上と単価 50% 削減の組み合わせが実装のハードルを大きく下げる。
- 国内 SaaS のルーティング設計への影響: [国内 AI エージェント開発企業] のような中規模事業者は、全リクエストを最上位モデルで処理する構成から、タスク難易度に応じて Sol を経由させる二段構えのルーティングへ移行するインセンティブが生まれる。
3. 根拠・詳細(How)
- 推論 effort とキャッシュ機構の分離設計: AutomationBench において Sol は xhigh 設定時に Claude Opus 5 max を上回る成果を 9% のコストで達成しており、明示的なキャッシュブレークポイントの導入によりキャッシュミス率を 50% 以上削減している。
- 出力トークン最適化とコード生成の挙動: Astra 由来の洗練された応答スタイルを継承し、冗長な前置きやプロンプトの繰り返しを削減することで、コーディングセッションにおける無駄な出力トークン消費を抑制する設計となっている。
4. 展望・課題(Next)
- デスクトップ版および無料枠への展開: 無料プランおよび Go プランのデスクトップアプリに Luna が順次導入される予定であるが、標準 Chat アクセスにおける両モデルの全面的な有効化時期は未定である。