Qwen3.8-27B FP8モデル公開
원제: Qwen 3.8 27B
왜 중요한가
270억 파라미터급 오픈 FP8 모델의 등장으로 고성능 추론 모델의 로컬 배포 및 연구 활용 가능성이 확대된다.
Alibaba傘下のQwenチームは、Hugging Face上にQwen3.8シリーズの新モデル「Qwen3.8-27B-FP8」を公開した。同モデルは270億パラメータ規模のFP8量子化モデルであり、thinking(추론 모드)과 non-thinking 두 가지 모드를 지원하며, 추론 노력 수준을 xhigh・medium・low로 조절 가능하다。
Alibaba Cloudが開発するQwenチームは、Hugging Face上で「Qwen3.8-27B-FP8」を공개했。本モデルはQwen3.8シリーズに属し、270억 파라미터 규모의 FP8 양자화 버전이다。
공개된 모델 카드에 따르면, 해당 모델은 `enable_thinking` 파라미터를 통해 추론(thinking) 모드와 일반 응답(non-thinking) 모드를 전환할 수 있다. 추론 모드에서는 `reasoning_effort` 값을 `xhigh`(기본값), `medium`, `low` 세 단계로 설정 가능하며, `xhigh` 시에는 핵심 가정 검증 및 대안 고려를 포함한 심층 추론을 수행하고, `low` 시에는 간결하고 직접적인 결론 도출을 우선한다.
또한 이미지, 동영상 등 멀티모달 입력을 지원하는 채팅 템플릿이 포함되어 있으며, 비전 토큰(`<|vision_start|>`, `<|image_pad|>` 등)을 활용한 멀티모달 처리가 가능하다. 도구 호출(tool call) 기능도 지원하며, 지정된 XML 형식을 통해 함수 호출을 수행할 수 있다.
FP8 양자화 적용으로 메모리 효율성을 높이면서도 대규모 파라미터 모델의 성능을 유지하는 것이 특징이다. 모델은 Hugging Face 허브를 통해 누구나 접근할 수 있다.