📜 papers

2026-09-27 · 5 topics

LLM は 2 つの思考を同時に処理可能──線形重ね合わせ仮説の検証と同時生成手法

🔥🔥

Transformer における入力の線形結合と次トークン分布の重ね合わせを実証し、軽量なファインチューニングで線形性を復元する guided decoding 手法を提案。

397B パラメータのテキスト動画生成向けプロンプト拡張モデル WanPE──30 秒生成で人間の好ましさを 50.86pt 向上

🔥🔥

動画グラウンデッド逆構築と SC-GRPO により、30秒の長尺動画における一貫性と演出力を大幅に向上させた。

Ovis-Embedding: テキスト・画像・動画・音声を統合するオムニモーダル埋め込みモデル──MMEBやMVEBでSOTAを達成

🔥🔥

共有マルチモーダルバックボーンと均質ソースサンプリングにより、テキストから音声まで任意のモダリティを単一の表現空間に統合し、主要なマルチモーダル検索ベンチマークで最高性能を更新した。

AI研究エージェントの再帰的自己改善手法AIDE^2──8日間の自律運用で7世代の性能向上と報酬ハッキング率の半減を実証

🔥🔥

自らのコードを最適化対象とする再帰的自己改善ループにより、探索ポリシーやメモリ機構の改良を重ね、4つのホールドアウトベンチマークで人間が設計した商用エージェントを凌駕した。

GLM-4.5-Air-Base ベースの 8 段階オープンポストトレーニング手法 Rufus-Air 公開──公式モデル超えを達成

🔥🔥

GLM-4.5-Air-Base を起点とした 8 段階のシリアルパイプラインによるポストトレーニング手法を提案し、公式リリースモデルを上回る性能を実証した。