🧠 research

2026-08-17 · 8 topics

NVIDIA、推論特化モデル NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4 を公開──3B アクティブパラメータと 1M トークン長を実現

🔥🔥🔥

Mamba と MoE を組み合わせたハイブリッド構造により、30B 全体パラメータのうちアクティブ 3B で高スループット推論と 1M トークンの長文脈処理を両立した。

研究チーム、米小学校カリキュラム限定の学習モデル LittleLearner を公開──事前学習データが能力上限を決定することを実証

🔥🔥

K-5 カリキュラムに制限した 88B トークンのコーパスで 0.6B から 5B までのモデルを事前学習し、SFT や GRPO などのポストトレーニングでも事前学習の境界を超えた能力獲得が困難であることを示した。

LLM 開発の構造転換──パラメータから事実を削り reasoning 特化へ

🔥🔥

モデルの事実記憶を削り reasoning とハーネス(外部検索)へ全振りすることで、推論コストを下げながら高度なタスク処理を実現する設計トレンドを解説する。

Anthropic、マルチエージェントシステムのパターンと課題に関する研究論文を発表──Claude 4.8 / Mythos 評価で協調動作の限界を実証

🔥🔥

複数エージェントによる脆弱性探索やゲーム開発の実験を通じ、独立型と協調型スウォームのトレードオフやモデル世代ごとの協調挙動の違いを検証した。

InclusionAI、ハイブリッド推論モデル Ling-3.0-tiny を公開──7.9B パラメータでアクティブ 1.3B の高効率 MoE

🔥🔥

KDA と MLA を組み合わせた効率的ハイブリッド構造を採用し、1.3B のアクティブパラメータで高度な推論とエージェント機能を実現した。

Prime Intellect、AI 自律研究モデル Fable 5 を公開──人間研究者の記録とのギャップを 82% 短縮

🔥🔥

nanoGPT 最適化の自動実行テストにおいて 18 のフロンティアモデルを検証し、Fable 5 が人間記録の 81.7% に到達した。

強化学習解説:方策のエントロピー計算手法と学習制御の仕組み

🔥

シャノンエントロピーを用いた方策の多様性・不確実性の数値化手法と、PyTorch実装による探索維持のメカニズムを解説。

ulamai、評価ベンチマークデータセット UnsolvedMath を HuggingFace で公開

🔥

未解決問題の数学的論理を LLM に検証させるためのテストデータセットであり、現時点でデータセット構造に JSON パースエラーが確認されている。