2026-09-03 · 8 topics
Google、推論・コーディング特化の次世代アーキテクチャモデル Gemini 3.8 Flash および 3.8 Flash Cyber を公開
🔥🔥🔥推論効率を維持したままマルチステップ推論能力を大幅に高め、セキュリティ特化モデルの Cyber 版では競合の大型モデルを超える脆弱性修正精度を実現した。
Anthropic、Claude Fable/Mythos 5.1 を発表──キャッシュ読込費 75% 削減と推論スコア 66 を達成
🔥🔥🔥プロンプトキャッシュ読込料金の大幅引き下げにより長文脈エージェントの運用コストを抑制しつつ、AI 評価インデックスで最高値を更新した。
Meta、エージェントモデル Muse Spark 1.3 を発表──ツール呼び出し数を 20% 削減
🔥🔥タスク実行時のツール呼び出し数を 20% 削減し、限界点を認識してハルシネーションを抑制する設計へ刷新された。
Google、モデル Gemini 3.8 Flash を公開──推論とコーディング性能を強化
🔥🔥Google が 6 週間で 3 番目となる Flash モデルを投入し、API 料金を年末まで半額の 100 万トークンあたり入力 $0.75 / 出力 $3.75 に設定した。
Google、サイバー防衛モデル Gemini 3.8 Flash Cyber と CodeMender ハネスを Fairwind Program で公開──脆弱性の自動修正を数分に短縮
🔥🔥Google Cloud 顧客や政府機関向けに、Gemini 3.8 Flash Cyber と CodeMender を統合した Fairwind Program を提供し、脆弱性の発見から検証・パッチ生成までを自律的に数分で完了させる。
IBM、時系列モデル群を Confluent Cloud に統合──Apache Flink SQL でリアルタイム予測と異常検知を実現
🔥🔥IBM の時系列基礎モデルを Confluent Cloud の Apache Flink にネイティブ統合し、専用の ML インフラ構築なしでストリーミングデータに対する高精度な予測・異常検知を SQL から直接実行可能にした。
Multiverse Computing、欧州最高峰の推理モデル Quasar 438B を公開──Artificial Analysis で 43 を記録し高速推論を実現
🔥🔥スペインの AI 圧縮技術を活用し、438B のパラメータ規模ながら 500 トークンの応答を 15.3 秒で返す実用的な欧州製推論モデル。
Alibaba、コード特化モデル Qwen3.8-Max-0902 を公開──Code Arena WebDev で Claude Opus 5 を上回り首位を獲得
🔥🔥パラメータ数や価格を据え置いたままポストトレーニングを刷新し、TerminalBench などのエージェントコーディング性能を大幅に引き上げた。