🧠Research🔥🔥🔥

Google、推論モデル Gemini 3.8 Flash を発表──価格据え置きでコーディング・推論性能を最適化

前世代 Gemini 3.7 Flash の価格を維持しながら、コーディングや推論、エージェントワークフローでの性能を大幅に向上させた。
リリース: 2026-09-07 · 読了 3

記事の要約

1. 核心(What)

  • Googleは2026年9月2日、推論およびコーディング性能を高めたAIモデル「Gemini 3.8 Flash」を発表した。
  • 価格は前世代のGemini 3.7 Flashと同等であり、API利用料金は入力100万トークンあたり0.75ドル、出力100万トークンあたり3.75ドルに設定されている。
  • サイバーセキュリティの防衛に特化した派生モデル「Gemini 3.8 Flash Cyber」も同時に発表された。
  • ソフトウェア・エンジニアリングのコーディング性能を測るベンチマーク「DeepSWE v1.1」において、Claude Opus 5級の大規模モデルに匹敵するスコアを低コストで記録した。

2. 影響(Why)

  • 開発コストの圧縮と性能の両立: 前世代と同等の低価格を維持したまま大規模モデル並みの推論・コーディング性能を得られるため、エージェントシステムのAPIコストを大幅に削減できる。
  • 国内SaaS開発者への実装メリット: [国内 AIエージェント開発受託・SaaS企業] のような中堅テック企業では、高額なプロプライエタリモデルの代替として本モデルを採用することで、複数ステップの推論タスクを伴う機能を低単価で実装可能になる。

3. 根拠・詳細(How)

  • 思考ステップの動的制御: 複雑なタスクにおいて追加の推論ステップを実行し、必要に応じて外部ツールを動的に呼び出すことで、出力の正確性と効率を最適化するアーキテクチャを採用している。
  • API料金の維持: 入力100万トークンあたり0.75ドル、出力100万トークンあたり3.75ドルの価格体系をGemini 3.7 Flashから引き継いでいる。

4. 展望・課題(Next)

  • Cyberモデルの提供拡大: パートナーシッププログラム「Fairwind Program」を通じて防衛関連の重要インフラ利用者向けに順次提供される予定。