📜 papers
2026-07-19 · 5 topics
ToolAnchor:エージェントのツール利用能力を向上させる反事実的アンカーコンテキスト手法
🔥🔥固定ツールセットに依存するエージェントの行動慣性を解消し、新規ツール導入時の適応能力を向上させる学習フレームワークを提案。
Embodied AI向け基盤モデルRxBrain──言語と視覚的想像を統合した計画生成で実ロボット操作を実現
🔥🔥言語による抽象的計画と視覚的想像による状態予測をMixture-of-Transformersで統合し、大規模な行動データなしで実ロボットでの操作性能を実証した。
マルチエージェント型レッドチーミングによるハードケース自動生成手法──画像安全性ベンチマークでFNRを16.7pt削減
🔥🔥高推論能力を持つArchitectエージェントと検証委員会による自動生成で、人間によるラベル付けなしにMLLMの安全性と堅牢性を向上させる。
報酬不要の自己進化エージェントを実現するペアワイズバリデーター手法
🔥🔥スカラー報酬の代わりに凍結済みLLMによるペアワイズ比較を用いることで、ラベルコストを削減しつつ既存手法と同等の性能を達成した。
Muon最適化手法の幾何学的特性を解明するMuse──行列表現が学習ダイナミクスに与える影響を分析
🔥🔥Muonの行列表現を選択可能な最適化手法Museを提案し、表現形式が特異値チャネルのサポート数や収束特性に与える影響を理論的・実験的に実証した。