Alibaba、Qwen3.8-27B-FP8モデルをHugging Faceで公開
Judul asli: Qwen 3.8 27B
Mengapa Ini Penting
中国発の大規模モデルがFP8量子化対応で公開され、オープンソースLLM競争が加速している点で業界注目度が高い。
Alibabaは270億パラメータのQwen3.8-27B-FP8モデルをHugging Face上で公開した。FP8量子化形式で提供され、推論効率の向上を図る。
AlibabaのQwenチームは、270億パラメータを持つ大規模言語モデル「Qwen3.8-27B」のFP8量子化版をHugging Faceにて公開した。モデル名に含まれる「FP8」は8ビット浮動小数点形式を指し、通常のBF16やFP16と比較してメモリ使用量を削減しつつ、推論速度の向上を実現する量子化手法である。このモデルはQwenシリーズの最新世代にあたり、テキスト・画像・動画を含むマルチモーダル入力に対応したチャットテンプレートを採用している。テンプレートには「enable_thinking」パラメータが組み込まれており、推論努力レベルを「xhigh」「medium」「low」から選択可能。ツール呼び出し機能もサポートしており、外部関数との連携が可能な設計となっている。Hugging Face上でモデルウェイトおよびトークナイザー設定が無償公開されており、研究者や開発者が直接利用できる。