📜 papers

2026-08-07 · 5 topics

複数視点の動的状態を分離するマルチプレイヤーワールドモデル MASS──1,024 人の同時接続で 10,000 ステップの安定予測を実証

🔥🔥

世界の状態と視点依存の視覚潜在表現を切り離すことで、従来のマルチビューベースライン比で高精度な状態維持と視点整合性を実現した。

可変タイムステップ推論を実現する気象予測モデル GEM-3──単一の重みで予測時間と精度のトレードオフを解消

🔥🔥

パラメータ数 134M の neighborhood-attention transformer により、推論時にタイムステップを動的変更しながら高いロールアウト安定性を実証。

LLM 安全性評価の盲点を突く──API とチャット UI・Web 検索の有無で精度が最大 8pt 低下することを実証

🔥🔥

BBQ と SafetyBench の検証から、単一の正解率指標や API 単体評価では実運用時の挙動を捉えきれないことを複数の不一致データで示した論文。

大規模言語モデルによるリアルタイムな陰謀論の信奉低減──暗殺事件直後の実験で有意な効果を実証

🔥🔥

主要な社会事件の直後にLLMとの対話型介入を実施し、既存の静的ファクトシートや対照群と比較して陰謀論の信奉度を統計的有意に低下させた。

AI エージェントの署名ワークフロー保護に向けたハードウェアキーストア──ゼロトラスト MCP アーキテクチャで攻撃成功率 0.0% を達成

🔥🔥

ソフトウェア上の秘密鍵露出を防ぐため、ハードウェアキーストアと5層のゼロトラスト enforcement スタックを導入し、悪意あるプロンプトインジェクションに対する防御性能を検証した。