🧠 research

2026-10-05 · 8 topics

ISTA-DASLab、非一律量子化モデル Qwen3.8-Flash-Next-GSQ-RCO-GGUF を公開──512エキスパート MoE のサイズを 5.3x 圧縮

🔥🔥🔥

各テンソル単位の感度に基づいた非一律量子化(GSQ・RCO)により、512 エキスパート MoE の 354 GB モデルを 66.4 GB(Q2_0)まで圧縮しつつ AIME25 で 96.67 を維持した。

Mininglamp Technology、視覚モデル VisionHOPE をオープンソースで公開──ImageNet-1K で DeiT や Vim を上回る精度を達成

🔥🔥

推論時に 5 つのメモリと学習則を共進化させることで、トークン数に対する線形計算量を維持しつつ高解像度画像での認識精度を高めた。

ByteShape、圧縮モデル Qwen3.8-27B GGUF 版を公開──8.8 GB の VRAM で秒間 176 トークンを達成

🔥🔥

ShapeLearn によるテンソル別量子化により、Qwen3.8-27B を 8.8 GB から 13.1 GB に圧縮し、RTX 5090 環境での高速推論を実現した。

Aleph Alpha、オープン推論モデル Kolibri-1 を公開──78B MoE で 1M トークン長に対応

🔥🔥

欧州の主権 AI を標榜する Aleph Alpha が総パラメータ 78.1B、アクティブ 3.46B の MoE アーキテクチャを持つオープンモデル Kolibri-1 を Apache 2.0 ライセンスで発表した。

Contrastive-LM、軽量な対照学習モデル CLM-v0.1-8B を公開──Qwen3-8B ベースで最大 9 倍の推論高速化を実現

🔥🔥

Qwen3-8B エンコーダの上に状態・行動の射影ヘッドを配置し、双方向 InfoNCE 損失で訓練することで、エージェントタスクでの高速化と高精度化を両立させた。

LightwheelAI、一人称視点データセット EgoDemo を公開──EgoSuite-Open100K から 50 時間分を抽出

🔥🔥

LeRobot v3 と MCAP 形式に対応した 50 時間分の開発者向けサンプルを HuggingFace Spaces で提供し、ロボット学習の初期検証コストを下げた。

VieNeu-TTS、音声合成モデル VieNeu-TTS v3 Turbo を公開──48 kHz ベトナム語音声の CPU 実行と OpenAI 互換 API を実現

🔥🔥

約1万時間の音声データでゼロから学習した100Mパラメータのオープンソースモデルで、CPU単体での高速な音声合成と16多重のストリーミング出力を両立した。

最新研究、AI が数学でつまずく主因は計算ミスではなく解き方の糸口の欠如と判明──83.6%で初期のひらめきに失敗

🔥

問題文だけから解法のカギを見つける確率が 25% 程度にとどまる一方、正解を示した状態なら 92% が見抜ける検証結果を公開。