🧠Research🔥🔥Liquid AI、推論高速化モデル LFM2.5-DSpark を公開──GPU とエッジで最大 3.2 倍の高速化を実現DSpark アーキテクチャにより GPU で最大 3.18 倍、エッジデバイスで最大 2.87 倍の推論スループット向上と関数呼び出しレイテンシ 57% 削減を達成した。リリース: 2026-08-20 · 読了 3 分LLMInferenceSpeculativeDecodingHuggingFaceHuggingFace Blog (2026-08-20 公開)記事の要約3. 根拠・詳細(How)HuggingFace Blog (2026-08-20 公開)📘 Docs