Google、推論サーバー AX を公開──エージェント専用の宣言型オーケストレーターで数百万規模のタスクを制御
ステートフルで待機時間が長いエージェントの特性に合わせ、0秒起動のサスペンド・レジュームと Kubernetes 統合を提供する。
リリース: 2026-09-22 · 読了 3 分記事の要約
1. 核心(What)
- Google がエージェント専用の宣言型オーケストレーター「AX」を公開した。
- YAML による宣言的なタスク定義と、`ax apply` や `ax ssh` などの CLI コマンドを提供する。
- Agent Substrate を基盤とし、クラスタあたり数百万の並行エージェントセッションに対応する。
- アイドル状態のエージェントをチェックポイント保存してサスペンドし、1 秒未満で再開できる。
2. 影響(Why)
- 無限ループによるコスト暴走の抑制: 従来のステートレスなマイクロサービスやバッチ処理用インフラではエージェントの待機コストが高騰するため、専用のランタイムでコストを抑制できる。
- 国内 SaaS のエージェント運用コスト削減: 国内で自社製 AI エージェントを本番運用する垂直統合型 SaaS は、アイドル時のリソース課金を削減しインフラ費用を最適化できる。
3. 根拠・詳細(How)
- Agent Substrate による軽量アクター構造: 各タスクを軽量なアクターとして実行し、モデルの応答待ちなどのアイドル時間をコンピュート容量に転換する設計を採用している。
- apiVersion ax.io/v1alpha1 による宣言的構成: Workspace および Task のカスタムリソースを定義し、Git リポジトリや MCP サーバーのセットアップを自動化する。
4. 展望・課題(Next)
- 商用環境でのスケーラビリティ検証: 数千〜数万の並行タスクを実行する大規模プロダクト環境での実負荷検証が今後の課題となる。