2026-09-30 · 8 topics
OpenAI、GPT-6.1 Sol などの開発者向け新機能を発表──トークン単価を 1/5 に抑制し推論速度を最大 300 トークン/秒に強化
🔥🔥🔥GPT-6.1 Sol の導入により長文脈の試行錯誤コストを圧縮しつつ、Ultrafast ティアやクラウド版 Codex でエージェント開発の実装レイテンシを大幅に改善する。
OpenAI、モデル GPT-6.1 Sol を発表──GPT-6 Astra 級の性能を 1/5 の低価格で実現
🔥🔥🔥GPT-6 Astra 級の高度なエージェント・プログラミング性能を持ちながら、入力・出力トークン単価を標準の 1/5 に抑えた新モデル。
Vals AI、Vals Index v2.1 を公開──Terminal-Bench 4 と税務タスク部門を追加してモデル比較を刷新
🔥🔥Terminal-Bench 4 と Tax Agent Bench を組み込み、Claude Opus 5.5 が 69.69% で総合首位を獲得した。
Cerebras、レストラン予約エージェントの処理速度ベンチマークを公開──Qwen3.5 27B と専用推論基盤で 22 秒を達成
🔥🔥Cerebras Inference Cloud と Qwen3.5 27B を組み合わせた予約エージェントが、従来モデル比 19 倍の 22 秒で完了した仕組みを実証した。
DeepSeek、推論モデル DeepSeek V4 Flash を公開──ARC-AGI-1 のタスク単価を 19 ヶ月で 99% 削減
🔥🔥ARC-AGI-1 で 75% 達成コストを 1 タスクあたり 0.01 ドルまで圧縮し、50 回の推論呼出を伴うエージェントワークフローを 1 ドル台で実用化する経済性を提示した。
Google Research、画像生成モデル向けアーキテクチャ Diffusion Controller を公開──HPS-v2 で 90% の勝率を記録
🔥🔥凍結したベースモデルの重みを変更せず、サンプリング時の各ステップに横付けする小規模ネットワークでプロンプト追従性を最適化する。
Google Research、画像生成制御フレームワーク Diffusion Controller を発表──軽量ステアリングダンパーでプロンプト整合性と画質を最適化
🔥🔥ベースモデルの重みを完全凍結したまま軽量な補助ネットワークでプロンプト追従性を高め、ブラックボックスモデルでも LoRA を上回る制御を実現した。
Liquid AI、新型モデル d1 を発表──トークン生成ゼロで型付き判定を返す決定モデル
🔥🔥テキスト生成のデコード処理を省き、分類やルーティングの推論コストとパース不良を根絶する専用APIを公開した。