2026-09-03 · 5 topics
LLM 事前学習の損失ダイナミクスを支配する有効学習率 ELR の発見──異なる設定間で損失軌跡が完全に一致することを実証
🔥🔥学習率とパラメータノルムの比である有効学習率 (ELR) を一致させることで、オプティマイザやアーキテクチャが異なる条件でも損失軌跡が崩壊(一致)することを解明した。
LLM の動的情報獲得能力を検証する非公開情報下競技プログラミングベンチマーク InteractBench を公開
🔥🔥Codeforces や AtCoder から厳選した 322 のインタラクティブ問題により、最先端推論モデルにおけるプロトコル違反やクエリ予算超過などの弱点を網羅的に診断する。
Text-to-Image モデルの Machine Unlearning における干渉現象の分析手法 I-CARE の提案
🔥🔥テキストから画像を生成するモデルの知識消去において、保持すべき関連概念への干渉を体系的かつ再現性高く評価するフレームワーク I-CARE の設計と実証結果。
コンピュータ科学論文の図版理解を強化する大規模データセット SCAFFOLD の構築──15.7万件の QA と推論トレースを公開
🔥🔥arXiv の計算機科学論文から抽出した 29,887 枚の図版と 157,387 件の QA・Chain-of-Thought 推論トレースを含む大規模データセット SCAFFOLD を提案し、視覚言語モデルの構造的理解力を向上させる。
複数領域間数学的探索を行うマルチエージェントシステム EULER──120件の未解決予想に対して10件の証明と3件の反証を達成
🔥🔥ドメイン間のブリッジ探索を単位として競合・検証を行うマルチエージェントシステム EULER を提案し、120件の未解決予想から10件の証明と3件の反証を得た。