📜 papers

2026-07-21 · 5 topics

Chain-of-Thoughtの悪用でGPT-4.1の脱獄成功率が10倍に──推論トレース転送の脅威を実証

🔥🔥🔥

有害なCoTトレースの転送およびパターン抽出によるブラックボックス攻撃を提案し、推論能力を持つモデルが従来の安全対策をすり抜ける脆弱性を明らかにした。

Large Reasoning Modelの拒絶応答はCoTと活性化の二重構造──DeepSeek-R1-Distill-LLaMA-8Bで実証

🔥🔥

LRMにおける拒絶応答は活性化ステアリングだけでは制御困難であり、CoTが拒絶信号を保持・再構築することでコンプライアンス率を低下させることを明らかにした。

MLLM-DataEngine:マルチモーダル学習データ生成の閉ループ化手法

🔥🔥

評価結果からモデルの弱点を特定し、適応的に学習データを追加生成する閉ループシステムにより、人手を介さずMLLMの能力を向上させる。

医療特化型LLM「Cura 1T」──人間介在型の自己進化ループで臨床推論とツール操作を統合

🔥🔥

1兆パラメータ規模の医療特化モデルCura 1Tは、人間が介入する自己進化ループにより、臨床推論からEHRツール操作までを網羅し、主要医療ベンチマークで最高水準の性能を達成した。

Xiaomi-Robotics-1:10万時間の実世界データで学習したVLAモデル、RoboCasa365で成功率57.6%を達成

🔥🔥

10万時間超の操作軌跡と自動ラベル付けパイプラインにより、未知環境での汎用性と高効率な微調整性能を両立した。