🧠 research
2026-07-19 · 5 topics
Moonshot AI、2.8T パラメータのオープンモデル Kimi K3 を発表──Frontend Code Arena で首位を獲得
🔥🔥🔥Claude Opus 4.8 級の推論能力を Sonnet 5 相当の低コストで実現し、Frontend Code Arena で Claude Fable 5 を上回る 1679 点を記録した。
Fable 5 と GPT-5.6 Sol、NP 困難な最適化問題で比較──/goal 機能の有効性を検証
🔥🔥最適化問題における /goal 機能は試行回数を増やすが、平均性能を悪化させるリスクがあることが判明。
Sebastian Raschka、LLM の推論努力制御手法を解説──GPT-5.6 世代の推論モード実装の仕組み
🔥🔥推論モデルにおける「思考努力」の可変設定と、RLVR(検証可能報酬を用いた強化学習)による学習プロセスの本質を紐解く。
Apple、画像セットから概念を推論するモデルアーキテクチャ VICIS を発表
🔥🔥VLM が苦手とする「少数の例示画像から概念を抽出して新規生成へ反映する」タスクを、専用の学習フレームワークで解決する手法。
ATH-MaaS、文書解析モデル OvisOCR2 を公開──0.8B パラメータで OmniDocBench 96.58 を記録
🔥🔥Qwen3.5-0.8B をベースに RL を含む多段階学習を施し、パイプライン手法を凌駕する精度を単一モデルで実現した。