📜 papers
2026-09-17 · 5 topics
属性条件付き画像編集で敵対的事例を生成する SemanticAdv ──実世界ブラックボックス API に対する高い攻撃成功率を実証
🔥🔥分離された意味的要因を用いて画像を変化させ、L_p ノルム制限なしで DNN の誤作動を引き起こす SemanticAdv 手法を提案し、Azure Face などの実世界サービスでの有効性を示す。
LLM の少ショット劣化の主原因を解明する──ランダムテキスト対照実験でプロンプト長の影響を分離し因果関係を実証
🔥🔥12モデル・2タスクの検証により、従来の「歪み仮説」に反してデモ内容の表現再構築が少ショット性能向上を駆動することを発見した。
LLM 推論ネットワークの最適モデル活性化方針──期待コストを大幅に削減する閾値ベースのルーティング手法
🔥🔥複数 LLM を連携させる推論ネットワークにおいて、モデルの信頼度に基づく閾値制御により性能制約を満たしつつコストを最小化する方針を定式化。
軽微なタイポが LLM の内部プローブを攪乱するメカニズムの解明──不正検知プローブの TPR を 12pp 低下させる弱点を修正する KV キャッシュフォークの提案
🔥🔥プロンプトへの軽微なタイポや句読点落ちが隠れ状態を 43〜56 度回転させてプローブを機能不全に陥れる現象を特定し、KV キャッシュフォークによって検知精度を 95% 回復させた。
10種のバイアス監査ツールは偏りを検出すれどもモデル間の優劣ランキングには失敗する──Frontier Models 10種とツール10種の検証から判明
🔥🔥10種の最先端モデルと監査ツールを用いた検証により、バイアスの検出自体は成功するもののツール間のランキング合意度は偶然レベル(KendallのW=0.07)にとどまることが判明した。