📜 papers

2026-07-19 · 5 topics

ToolAnchor:エージェントのツール利用能力を向上させる反事実的アンカーコンテキスト手法

🔥🔥

固定ツールセットに依存するエージェントの行動慣性を解消し、新規ツール導入時の適応能力を向上させる学習フレームワークを提案。

Embodied AI向け基盤モデルRxBrain──言語と視覚的想像を統合した計画生成で実ロボット操作を実現

🔥🔥

言語による抽象的計画と視覚的想像による状態予測をMixture-of-Transformersで統合し、大規模な行動データなしで実ロボットでの操作性能を実証した。

マルチエージェント型レッドチーミングによるハードケース自動生成手法──画像安全性ベンチマークでFNRを16.7pt削減

🔥🔥

高推論能力を持つArchitectエージェントと検証委員会による自動生成で、人間によるラベル付けなしにMLLMの安全性と堅牢性を向上させる。

報酬不要の自己進化エージェントを実現するペアワイズバリデーター手法

🔥🔥

スカラー報酬の代わりに凍結済みLLMによるペアワイズ比較を用いることで、ラベルコストを削減しつつ既存手法と同等の性能を達成した。

Muon最適化手法の幾何学的特性を解明するMuse──行列表現が学習ダイナミクスに与える影響を分析

🔥🔥

Muonの行列表現を選択可能な最適化手法Museを提案し、表現形式が特異値チャネルのサポート数や収束特性に与える影響を理論的・実験的に実証した。