📜 papers
2026-10-03 · 5 topics
DynaFlow:プログラム可能な演算子スケジューリングによりデバイス内並列化を統合するフレームワーク──スループットを最大 1.29 倍に向上
🔥🔥論理モデル定義と物理実行スケジュールの分離により、既存コードの大幅な改修なしで多様なデバイス内並列化戦略を統合し、推論・学習時のリソース稼働率を改善する。
医療タスク向け非生成型 AI「Jev 1.13」の性能評価──PubMedQA で 78.4% を記録するも臨床診断ケースでは課題
🔥🔥Jev 1.13 を 4 つの医学ベンチマークで評価し、PubMedQA では GPT-6 Sol と同等の精度を達成する一方で、複雑な診断ケースでは精度低下が確認された。
LLM エージェントのツール実行を高速化する TomasuLLM──順序外実行で SWE-bench Verified を 1.31 倍に向上
🔥🔥CPU の順序外実行の概念を LLM エージェントに応用し、コピーオンライトサンドボックスで未来のツール呼び出しを先読み実行することで、タスク実行効率を最大 1.35 倍に高めた。
LLM のシステムプロンプトの内部計算への影響を CKA で解析──安全性指示は内部表現をほぼ変化させず
🔥🔥17モデル・8アーキテクチャでの解析により、ペルソナ指示は中間表現を大きく再構築する一方、安全性指示は最小限のベースラインと統計的に区別つかないレベルでしか影響しないことを解明した。
LLM サービング層の攻撃検知手法──オラクルラベル対比で実運用ラベルの AUPRC 0.313 の課題を実証
🔥🔥LLM サービングにおける敵対的インタラクションやインフラ乱用を防ぐため、因果モデルを用いたデータセットと勾配ブースティング検出器を提案し、ラベル観測可能性の限界を検証した。