2026-08-12 · 8 topics
研究チーム、LLM API の隠し推論ログを復元する攻撃手法を論文で発表──機密情報 704 件を抽出
🔥🔥主要な商用 LLM API の暗号化された推論ブロックから 315,320 件の reasoning trace を復元し、プライベートな機密情報がログに含まれるリスクを実証した。
IBM Research、エージェント記憶機構 ALTK-Evolve を発表──ACE 比で推論コストを最大約 1/7 に削減
🔥🔥エージェントの過去の失敗履歴を圧縮せずに個別ガイドラインとして保持し、モデルの処理能力に応じて動的に配信量を切り替えることで、ACE と同等以上の精度を低コストで実現した。
Mistral、欧州での推論基盤とオープンモデル選択肢を拡充──欧州インフラ確保に向けた提携枠組みを発表
🔥🔥Mistral Regional Endpoints の一般提供開始と SLA 付き Priority Tier の導入により、欧州におけるデータ主権と本番環境の信頼性を同時に担保する。
Google Research、医療 AI モデル AMIE のリアルタイム動画診察機能を発表──マルチモーダル対応で専門医並みの診断精度を実証
🔥🔥Gemini と Project Astra を基盤としたマルチエージェント構成により、音声や視覚情報をリアルタイムで解釈し、仮想的な身体診察をガイドする。
NVIDIA、推論特化モデル Nemotron 3.5 Lightning を公開──エージェントコストを 58% 削減
🔥🔥30B MoE アーキテクチャと 3B アクティブパラメータにより、同等クラス比で最大 4 倍の高速化とエージェント実行コスト削減を実現。
OpenAI、セキュリティ防衛モデル GPT-5.6 Cyber を発表──Daybreak サービスを Blue / Red の 2 階層へ拡張
🔥🔥OpenAI がセキュリティ防衛サービス Daybreak を拡張し、専用モデル GPT-5.6 Cyber を Red ティアに投入した。
OpenAI、未公開モデル Astra で 10 件の難問を解決──数学界に衝撃
🔥🔥OpenAI の未発表モデル Astra が数十年間未解決だった 10 件の数学の難問を突破し、Lean による証明検証で実効性が確認された一方、先行研究への謝辞を巡る議論も浮上している。
Sarvam AI、評価ベンチマーク Indic DiarBench を公開──全 22 言語で音声認識と話者分離を同時検証
🔥🔥インドの 22 公用語を対象に、話者分離と自動音声認識を結合評価する初のエンドツーエンドベンチマーク。