OpenAI、次世代モデル GPT-6 Astra を発表──ARC-AGI-3 で 99.9% のスコアを記録
PC操作やコーディング等のタスク性能を大幅に引き上げ、AI安全性の最高リスク「Critical」に到達した次世代基盤モデル。
リリース: 2026-09-08 · 読了 4 分記事の要約
1. 核心(What)
- OpenAIは2026年9月3日に次世代基盤モデル「GPT-6 Astra」を発表し、PC操作や高度なコーディング、サーバーセキュリティなどの領域で最高性能を主張した。
- 推論ベンチマーク「ARC-AGI-3」で99.9%を記録し、脆弱性作成ベンチマーク「ExploitBench」で100点に到達した。
- 入力トークン100万あたり10ドル、出力トークン50ドルの価格設定で、ChatGPT PlusやEnterprise、API、Azure、Bedrock経由で提供される。
- 「Codex」の実行環境が一新され、コンテキストウィンドウが溢れる際の詳細なnote保持機能や、Mind2Webで1.9倍の高速化を実現した。
2. 影響(Why)
- 自律エージェントの限界突破: PCの直接操作(Computer Use)と強化学習の組み合わせにより、単なるテキスト生成を超えた複雑な実タスクの自律遂行が可能になる。
- 国内開発組織への適用判断: 国内のAI受託開発を行う中堅SIerは、高水準なコード生成とセキュリティリスクの双方を勘案し、ローカル環境でのガバナンスポリシーを再設計する必要がある。
3. 根拠・詳細(How)
- コンテキスト管理の機構刷新: Codexのコンテキストウィンドウ制約による忘却を防ぐため、過去のコンテキストを詳細なnoteとして自動維持し、config.toml設定でデフォルト有効化される。
- 安全性と自律性のトレードオフ制御: Preparedness Frameworkの「Critical」評価を受け、PoCエクスプロイト作成などの高リスクタスクは制限しつつ、コードレビューやパッチ適用などの防衛側機能に特化させる。
4. 展望・課題(Next)
- OpenAI Daybreakでの機能拡張: 数週間のうちに予定されているOpenAI Daybreakプログラムを通じて、防衛側のエージェント機能の段階的公開が進められる。