Alibaba、Qwen3.8-27B-FP8モデルをHugging Faceで公開

Judul asli: Qwen 3.8 27B

Mengapa Ini Penting

中国発の大規模モデルがFP8量子化対応で公開され、オープンソースLLM競争が加速している点で業界注目度が高い。

Alibabaは270億パラメータのQwen3.8-27B-FP8モデルをHugging Face上で公開した。FP8量子化形式で提供され、推論効率の向上を図る。

AlibabaのQwenチームは、270億パラメータを持つ大規模言語モデル「Qwen3.8-27B」のFP8量子化版をHugging Faceにて公開した。モデル名に含まれる「FP8」は8ビット浮動小数点形式を指し、通常のBF16やFP16と比較してメモリ使用量を削減しつつ、推論速度の向上を実現する量子化手法である。このモデルはQwenシリーズの最新世代にあたり、テキスト・画像・動画を含むマルチモーダル入力に対応したチャットテンプレートを採用している。テンプレートには「enable_thinking」パラメータが組み込まれており、推論努力レベルを「xhigh」「medium」「low」から選択可能。ツール呼び出し機能もサポートしており、外部関数との連携が可能な設計となっている。Hugging Face上でモデルウェイトおよびトークナイザー設定が無償公開されており、研究者や開発者が直接利用できる。

Sumber

huggingface.co — Baca artikel asli →