2026-08-20 · 8 topics
Z AI、推論モデル GLM-5.3 の性能ベンチマークを公開──Intelligence Index 60 を記録
🔥🔥Z AI が開発したプロプライエタリな推論モデル GLM-5.3 (max) は、Artificial Analysis 評価でスコア 60 を記録し、1M トークンコンテキストと毎秒 91 トークンの高速出力を実現した。
NVIDIA、ロボット制御向けモデル Cosmos 3 Edge を公開──Jetson Thor で動く 4B オムニモデル
🔥🔥4B パラメータのワールド基盤モデルをエッジ環境に最適化し、NVIDIA Jetson Thor 上でリアルタイム推論とマニピュレーション制御を完全にローカル完結させる。
Liquid AI、LFM2.5 モデルの量子化蒸留モデル LFM2.5 Q4_0 を公開──BF16 精度ロスを 97% 回復
🔥🔥Quantization-Aware Distillation を用いて量子化精度ロスを 97% 回復し、Q4_0 の低メモリ・高スループットを維持した 4 モデルを公開した。
智譜AI、次世代モデル GLM 5.3 を公開──長距離エージェント最適化と超大コンテキストに対応
🔥🔥前世代の GLM-5.2 から約 2 か月という異例のスピードで投入され、1M 超のコンテキストにおける長期一貫性とエージェントタスクの安定性を強化した。
神戸大、ChatGPT の反論で道徳的判断の 3 割超が覆る現象を発見──高齢者ほど説得されやすい傾向
🔥🔥正解のない道徳問題において ChatGPT が与える影響を検証し、若者 56 人と高齢者 74 人の比較から認知機能と説得受容性の関係を定量化した。
NTT、国産小型言語モデル tsuzumi 2 を公開──全パラメータ利用の Dense 構成で日本語処理と運用性を最適化
🔥🔥Mixture of Experts を採用せず 28B の Dense 構成で 10T トークンを学習し、単一 GPU での運用性と高い日本語実用性能を両立した。
Cerebras、ラック型 AI システム CS-4 を発表──既存ウェハのオーバークロックで推論速度を 30 倍に最適化
🔥🔥新規シリコンの製造を回避し既存 WSE-3 を限界駆動させることで、GPU 比 30 倍の推論スループットとワット当たり 10 倍の効率を実現したシステム。
Comfy-Org、音楽生成モデル MiniMax-Music-3 の ComfyUI 対応版パッケージを公開──fp16・int8 などの重みを同梱
🔥🔥MiniMaxAI の音楽生成モデル MiniMax-Music-3 を ComfyUI のワークフローに直接組み込めるよう再パッケージ化した。