Qwen3.8-27B-FP8 : nouveau modèle sur Hugging Face

Original : Qwen 3.8 27B

Pourquoi c'est important

La quantification FP8 rend les grands modèles plus accessibles sur du matériel standard.

Alibaba Cloud a publié Qwen3.8-27B-FP8, une version quantifiée en FP8 de son modèle de langage Qwen3.8 à 27 milliards de paramètres, disponible sur la plateforme Hugging Face pour téléchargement et déploiement.

Le modèle Qwen3.8-27B-FP8 est une variante quantifiée au format FP8 du modèle Qwen3.8, développé par Alibaba Cloud via l'équipe Qwen. Avec ses 27 milliards de paramètres, il est conçu pour offrir des performances élevées tout en réduisant les besoins en mémoire GPU grâce à la quantification FP8. Le modèle supporte des capacités multimodales, incluant le traitement d'images et de vidéos, ainsi qu'un système de raisonnement configurable avec différents niveaux d'effort (xhigh, medium, low). Il prend également en charge l'appel d'outils externes (tool calling) via un format structuré. La fiche modèle est hébergée sur Hugging Face, la principale plateforme de partage de modèles d'IA open source, facilitant son accès à la communauté des développeurs.

Source

huggingface.co — Lire l'original →