📜 papers

2026-08-14 · 5 topics

サイバーセキュリティにおける LLM 生成検知ルールの評価フレームワークとベンチマーク

🔥🔥

LLM が生成したセキュリティルールの有効性を人間製コーパスと比較評価するオープンソースのフレームワークを提案し、専門家の評価手法にインスパイアされた 3 つの主要指標を導入した。

WavePhaseNet による意味的階層構造の構築──DFT 活用で 24,576 次元を 3,000 次元へ圧縮しつつハルシネーションを抑制

🔥🔥

DFT により埋め込み空間の周波数分解と SCHS 構築を行い、24,576 次元から 3,000 次元への次元削減と論理一貫性の制御を両立した。

LLM 推論信頼性向上手法の独立検証──RPC と LCF の一般化限界と効果の小ささを実証

🔥🔥

LLM の推論信頼性を高める RPC と LCF の 2 手法を独立検証し、新ドメインでは優位性が確認できないことや効果が限定的であることを示した。

マルチ LLM エージェント間の制御統制レイヤー Experience Orchestrator──金融シミュレーションでアドバイザー接触率を 32pt 向上

🔥🔥

Contextual Bandit と PID 制御を組み合わせた制御レイヤーにより、競合する目的を持つマルチ LLM エージェント間の破綻を防ぎつつ高精度な対話誘導を実現した。

文献情報からベイズモデルの事前分布を自動構築するエージェント型ツール Distribird──幻覚抑制とローカル実行を両立

🔥🔥

文献からパラメータの事前分布を自動設計するエージェント型システム Distribird を提案し、単一プロンプトベースラインと同等の精度を保ちつつハルシネーションを無効化した。