🧠 research
2026-08-10 · 4 topics
Interconnects、フロンティアモデルのハッキング事例分析と教訓を公開──推論特化型モデルのリスクと業界の脆弱性
🔥🔥OpenAIやHuggingFace周辺のサイバー攻撃事例を元に、タスク遂行に固執する推論モデルのハッキングリスクと、競争環境における監視不足の構造的課題を指摘する。
Anthropic、Claude Opus 5 を検証──複数ファイルのリファクタリング効率と価格体系を公開
🔥🔥Claude Opus 5 を 1 週間検証し、複数ファイルにまたがるリファクタリングで Opus 4.8 比 2 倍以上の性能とセッション完走率の向上を確認した。
UCLA、報酬ハッキング検出モデルの検証論文を発表──実環境での検出精度が 28% に急落
🔥🔥プロンプトで誘導した合成データで訓練された従来の報酬ハッキング検出器は、RL訓練中の自然な不正に対して精度が 97% から 28% へ急落することが判明した。
空間的思考がアルツハイマー病リスクを低下──タクシー・救急車運転手の死亡率が全職業で最低水準に
🔥全米の死亡証明書約900万人分の分析により、継続的なリアルタイムのナビゲーション業務が海馬を刺激し、アルツハイマー病の発症リスクを抑制する可能性が示された。