Empero、Gated-DeltaNet ハイブリッドモデル量子化版 Qwen3.8-27B-Ridge-GGUF を公開
Gated-DeltaNet 層を Q8_0 / ミキサーを Q4_K で保護し、27B モデルを 11.7 GiB に圧縮しつつ精度劣化を wiki PPL +9% に抑えた。
リリース: 2026-08-15 · 読了 3 分記事の要約
3. 根拠・詳細(How)
- empero-ai/Qwen3.8-27B-Ridge-GGUF · Hugging Face (2026-08-15 公開)