📜 papers
2026-08-26 · 5 topics
SLM を搭載した認知レーダー自動エージェント──自然言語指示によるアレイ信号処理の動的制御を実証
🔥🔥Small Language Model を活用し、自然言語の指示からレーダー運用パラメーターの抽出と適切な信号処理ツールの実行を自動化するフレームワークを提案した。
小規模言語モデル向け直接三線形積 FFN 手法 TriPLU──検証損失 1.0637 を達成
🔥🔥SwiGLU のゲート分岐を 3 つの射影ストリームの座標毎の積に置き換え、TinyStories 1M において検証損失 1.0637 を達成した。
RLVR における多言語ベリファイアバイアス──Qwen3-8B の日本語で偽陰性率 0.642 に達することを実証
🔥🔥RLVR の完全一致ベリファイアが多言語環境で言語依存の偽陰性報酬ノイズを生むことを示し、日本語における重大な評価バイアスを定量化した。
連続値感情空間を制御する LLM 向け学習手法 VA-DPO──平均 VA 距離を 33% 削減
🔥🔥Valence-Arousal 平面上の連続値で LLM の感情生成を制御する VA-DPO を提案。Llama-3.1-8B-Instruct においてシステムプロンプト比で平均 VA 距離を 33% 削減しつつ MMLU 精度を維持。
エージェント記憶の事前検索失敗を特定──DSGC 機構でフルチェーン保持率を最大 1.00 へ改善
🔥🔥固定予算下のエージェント記憶において前提条件が排除される構造的欠陥を定式化し、1 ホップグラフ連動型の DSGC により保持率を大幅に向上させた。