Cognition、エージェント SDK Devin に xAI の Grok 4.7 を追加──巨大差分とバックエンド開発のトレードオフ
Grok 4.7 は 2.1 兆パラメータの基礎モデルをベースに複雑なバックエンド開発で強みを発揮する一方、過剰なスコープ拡大によりレビューコスト増加の懸念がある。
リリース: 2026-09-21 · 読了 3 分記事の要約
1. 核心(What)
- Cognition は Devin Desktop および Devin CLI において xAI の Grok 4.7 を選択可能にした。
- Grok 4.7 は FrontierCode 1.1 Extended ベンチマークで 59.4% を記録した。
- モデルは 2.1 兆パラメータの基礎モデルを採用し、API 料金は入力 $2/M token、出力 $6/M token である。
- GitHub Copilot や Cursor でも同週に利用可能となった。
2. 影響(Why)
- マルチモジュール開発の自動化: Java や Go などの言語における依存関係の探索と統合テストの実行を伴う複雑なバックエンドタスクを処理できるため、大規模なコードベースを持つプロダクトの開発効率が向上する。
- 国内 SaaS における運用負荷の懸念: 過剰なスコープ拡大により周辺の未依頼コードまで修正する傾向があるため、国内の厳格なコードレビュー基準を持つチームではマージ前の確認コストが増加するリスクを検証すべきである。
3. 根拠・詳細(How)
- モデルアーキテクチャと検証スコア: Grok 4.7 は 2.1 兆パラメータの基礎モデルを採用しており、Grok 4.6 比で 40% 拡大しつつも、過剰スコープの影響で FrontierCode 1.1 Extended のスコアは 59.4% と微減した。
- API 価格と課金方式: xAI API を通じて入力 100 万トークンあたり 2 ドル、出力 100 万トークンあたり 6 ドルで提供され、Devin ではプロバイダの公開レートに基づく従量課金が適用される。
4. 展望・課題(Next)
- スコープ制御機能の追加予定: 過剰な差分出力を抑制するため、タスクのスコープ制限や不要なリファクタリングを防ぐフィルタリング機能の改善が求められる。