Google、次世代フロンティアモデル Gemini 4 Argon を発表──出力トークン数 1M 化とサイバー防御能力を強化
推論コストを維持したまま出力トークン上限を業界最大の 1M に拡張し、実世界での長文脈コーディングやサイバー防御の SOTA を更新した。
リリース: 2026-09-30 · 読了 4 分記事の要約
1. 核心(What)
- 次世代フロンティアモデル Gemini 4 Argon を発表し、まずは信頼されるサイバー防衛者向けにフェアウインドプログラムで提供を開始した。
- API 価格は入力 1M トークンあたり $2、出力 1M トークンあたり $10 で、キャッシュ済み入力は 95% 割引となる。
- 出力トークン上限を従来の 64K から 1M トークンへと大幅に拡張し、長文脈での深い推論を可能にした。
- DeepSWE v1.1 (77.9%)、AutomationBench (51.3%)、LVBench (91.7%) など複数の主要ベンチマークで SOTA を達成した。
2. 影響(Why)
- 大規模コード移行の実用化: 出力 1M トークンを活用した長文脈処理により、数万行規模の C/C++ から Rust への書き換えやリファクタリングを単一の推論パスで安全に実行できる。
- 国内 SaaS のコスト構造変化: キャッシュ済み入力の 95% オフと $2/$10 の価格設定により、長大なコンテキストを日常的に参照するエンタープライズ RAG の運用コストを劇的に抑制できる。
3. 根拠・詳細(How)
- 出力トークンの拡張機構: 出力トークン上限を従来の 64K から 1M トークンへ引き上げ、数百万トークンの文脈を維持したまま一貫したチェーンオブソートを生成するアーキテクチャを採用。
- サイバー防御特化のトレーニング: CWE-bench v1 で 68% のスコアを記録し、Wiz との連携による実証テストで複雑なコードベースや生ウェブシステムからの脆弱性自動検出と検証を実現。
4. 展望・課題(Next)
- 一般開発者・企業への順次展開: 初期テスターからのフィードバックを基に安全性のガードレールを強化し、ペイド API 顧客および Google AI Ultra 登録者へ順次公開予定。
- 高度なアライメント監視の導入: ミスアライメントを防ぐため、チェーンオブソートとアクションをリアルタイムで監視し必要に応じて実行を停止する仕組みを標準デプロイ。