2026-08-09 · 8 topics
OpenAI、次世代モデル Astra の開発を一部一時停止──自律的サイバー攻撃の閾値到達を受け
🔥🔥🔥Preparedness Framework の基準に基づき、エージェント型コーディングとサイバー攻撃能力の評価で Critical 水準に達したためガードレール適用を優先した。
Google DeepMind、気象予測モデル WeatherNext を発表──カテゴリー 5 のハリケーン上陸を 5 日前に 80% の確信度で予測
🔥🔥既存の気象モデルと比較して予報リードタイムを平均 1 日延伸し、災害対策の初期行動を加速させる。
Ant Group、推論特化モデル Ling 3.0 Flash を公開──アクティブ 5B で 1T モデル並みの性能を達成
🔥🔥アクティブパラメータを 5.1B に抑えながら総パラメータ 124B の MoE 構造とハイブリッド線形注意機構により、推論コストを大幅に削減しつつ上位モデルに匹敵するベンチマークスコアを実現した。
Liquid AI、軽量ハイブリッドモデル LFM2.5-2.6B を公開──2.69B パラメータで 128K コンテキストと高速推論を実現
🔥🔥2.69B パラメータのテキスト専用モデル LFM2.5-2.6B は 128K の長コンテキストとエージェント向け強化学習を備え、Apple M5 Max で 220 token/s の高速推論を達成した。
Mistral AI、軽量安全分類モデル Shieldstral-1.0-3B を公開──自然言語の安全ポリシー適応とマルチモーダル対応
🔥🔥3Bパラメータ規模の軽量なマルチモーダル安全分類器であり、推論時に自然言語でポリシーを与えて再学習なしでガードレールを動的変更できる。
AlphaSignal、長期エージェント評価ベンチマーク HANDBOOK.md を公開──最強 Claude Opus 4.8 でも正答率 36.2% の限界を実証
🔥🔥20〜124ページの社内ポリシーをコンテキストに与えた長手順エージェントタスクにおいて、推論能力が十分に高いモデルでも自己矛盾やルールの失念で破綻する 4 つのメカニズムを解明した。
Allen AI、AI 家庭教師の指導判断力を測る評価フレームワーク TutorMoments を公開
🔥🔥実録数学指導トランスクリプト 462 件と 1,500 超のアノテーションを基に、LLM が生徒への支援過剰や適切な負荷付与を判断できるかを検証する。
Anthropic、Fable 5 の生物学関連セーフティ制限を 85% 削減──誤検知による過剰ブロックを修正
🔥🔥安全性の過剰反応で日常的な医療・生物学の質問まで迂回させていた安全分類器を再学習させ、フォールバック頻度を最大 67% 削減した。