2026-09-06 · 5 topics
自然言語仕様書からローカルニューラル関数を生成するコンパイル手法──FuzzyBench-Hardで83.6%の精度を達成
🔥🔥教師モデルによる合成データでコンパクトなインタプリタ用アダプタを学習させ、リモートAPI依存を解消するコンパイル手法を提案した。
6B DiT 基盤の画像生成モデル LLaDA-Image──Qwen-Image-Bench で SOTA を達成し全訓練レシピを公開
🔥🔥凍結されたビジョン言語モジュールと 2.2 億サンプルによる事前学習により、Qwen-Image-Bench の英中両トラックでオープンソース SOTA を記録した。
GitHub リポジトリから 5,000 件のスキルを抽出する自律研究エージェント手法 DisCo──MLE-bench で 134.3% の性能向上を達成
🔥🔥オープンソースのリポジトリ群を検証済みスキルへと蒸留する DisCo により、AI エージェントは MLE-bench で 134.3%、PaperBench で 34.4% の性能向上を実証した。
KV キャッシュ圧縮におけるスコアリング不要論──ランダム退避で既存手法と同等の推論精度と 32-43% のスループット向上を両立
🔥🔥長文脈推論の KV キャッシュ圧縮において、プロンプトを保持しつつランダムにトークンを退避させる Random Attention を提案し、複雑なスコアリングを不要としながら既存手法と同等の精度と 32-43% のスループット向上を実証した。
長文脈インタラクションを実現するビデオ世界モデル SolarWM ── 143万クリップの統合データエンジンと5B-33Bモデル群をオープン化
🔥🔥異種データと多様なバックボーンを統合するデータエンジンと3段階の学習レシピにより、5秒の訓練から数分から数時間の長期ロールアウトを可能にするビデオ世界モデル群を実現した。