📜 papers
2026-08-06 · 5 topics
ICASSP 2026 URGENT Challenge 優勝の GAP-URGENet──生成・予測融合で音声強調の客観評価 1 位を獲得
🔥🔥自己教師あり表現ドメインでの生成分岐とスペクトログラムドメインの予測分岐を融合し、48 kHz 拡張を備えた音声強調フレームワークで客観評価 1 位を達成した。
自己進化型 LLM エージェントの動的ストリーミング評価手法 AgentStream──単一タスク評価の限界と汎化性を解明
🔥🔥自己進化型 LLM エージェントを多様なタスクストリームで評価するフレームワーク AgentStream を提案し、モデル能力と進化手法の関係を実証した。
GPU カーネル自動最適化エージェント KernelBrain──既存比最大 1.4 倍の高速化と 48% の最適化時間削減を達成
🔥🔥LLM を用いた変異と適応型リソース配分により、PyTorch 比で 0.88x-6.72x、既存エージェント比で最大 1.4 倍の高速化を実証した。
エッジ AI 向け個人メモリ評価ベンチマーク MemArena の提案──50 エージェント 15 日間の対話でメモリバックエンドの性能差を検証
🔥🔥50エージェントの15日間にわたる対話データをシミュレートし、オープンウェイトモデルを用いたオンデバイス型個人メモリの検索・推論性能を評価するベンチマーク MemArena を提案した。
OpenAI の Privacy Filter を 42 ベンチマークで独立評価──AI4Privacy で F1=0.855 を記録
🔥🔥1.5B パラメータの双方向 PII 検出器である OpenAI Privacy Filter の 22 言語・5 ドメインにおける交差言語・交差ドメイン性能を系統的に評価した。