🧠 research

2026-08-20 · 8 topics

Z AI、推論モデル GLM-5.3 の性能ベンチマークを公開──Intelligence Index 60 を記録

🔥🔥

Z AI が開発したプロプライエタリな推論モデル GLM-5.3 (max) は、Artificial Analysis 評価でスコア 60 を記録し、1M トークンコンテキストと毎秒 91 トークンの高速出力を実現した。

NVIDIA、ロボット制御向けモデル Cosmos 3 Edge を公開──Jetson Thor で動く 4B オムニモデル

🔥🔥

4B パラメータのワールド基盤モデルをエッジ環境に最適化し、NVIDIA Jetson Thor 上でリアルタイム推論とマニピュレーション制御を完全にローカル完結させる。

Liquid AI、LFM2.5 モデルの量子化蒸留モデル LFM2.5 Q4_0 を公開──BF16 精度ロスを 97% 回復

🔥🔥

Quantization-Aware Distillation を用いて量子化精度ロスを 97% 回復し、Q4_0 の低メモリ・高スループットを維持した 4 モデルを公開した。

智譜AI、次世代モデル GLM 5.3 を公開──長距離エージェント最適化と超大コンテキストに対応

🔥🔥

前世代の GLM-5.2 から約 2 か月という異例のスピードで投入され、1M 超のコンテキストにおける長期一貫性とエージェントタスクの安定性を強化した。

神戸大、ChatGPT の反論で道徳的判断の 3 割超が覆る現象を発見──高齢者ほど説得されやすい傾向

🔥🔥

正解のない道徳問題において ChatGPT が与える影響を検証し、若者 56 人と高齢者 74 人の比較から認知機能と説得受容性の関係を定量化した。

NTT、国産小型言語モデル tsuzumi 2 を公開──全パラメータ利用の Dense 構成で日本語処理と運用性を最適化

🔥🔥

Mixture of Experts を採用せず 28B の Dense 構成で 10T トークンを学習し、単一 GPU での運用性と高い日本語実用性能を両立した。

Cerebras、ラック型 AI システム CS-4 を発表──既存ウェハのオーバークロックで推論速度を 30 倍に最適化

🔥🔥

新規シリコンの製造を回避し既存 WSE-3 を限界駆動させることで、GPU 比 30 倍の推論スループットとワット当たり 10 倍の効率を実現したシステム。

Comfy-Org、音楽生成モデル MiniMax-Music-3 の ComfyUI 対応版パッケージを公開──fp16・int8 などの重みを同梱

🔥🔥

MiniMaxAI の音楽生成モデル MiniMax-Music-3 を ComfyUI のワークフローに直接組み込めるよう再パッケージ化した。