Qwen 3.8 27B:性能優秀だがデフォルトで過剰思考
मूल शीर्षक: Qwen 3.8 27B is excellent, but it defaults to overthinking things
यह क्यों महत्वपूर्ण है
लोकल मशीन पर चलने वाले 27B मॉडल की गुणवत्ता और डिफ़ॉल्ट reasoning सेटिंग के व्यावहारिक प्रभाव को उजागर करता है।
Alibaba की Qwen रिसर्च लैब ने Apache 2 लाइसेंस के तहत 27B पैरामीटर वाला विज़न-सक्षम LLM 'Qwen 3.8 27B' जारी किया। Simon Willison ने इसे M5 Max MacBook Pro और NVIDIA DGX Spark पर परखा। डिफ़ॉल्ट reasoning_effort सेटिंग 'xhigh' के कारण सरल कार्यों में भी अत्यधिक tokens और समय की खपत देखी गई।
Alibaba की Qwen रिसर्च लैब ने 'Qwen 3.8 27B' मॉडल जारी किया, जो Apache 2 लाइसेंस के तहत उपलब्ध है और 27 बिलियन पैरामीटर के साथ विज़न कैपेबिलिटी भी रखता है। यह मॉडल अपने पूर्ववर्ती Qwen 3.6 27B और क्लोज़्ड-वेट मॉडल Qwen 3.7-Plus दोनों से बेहतर self-reported benchmarks दर्शाता है।
Simon Willison ने इसे 128GB M5 Max MacBook Pro और NVIDIA DGX Spark दोनों पर LM Studio के 17GB Q4_K_M quantized बिल्ड के साथ चलाया। मॉडल का डिफ़ॉल्ट reasoning_effort 'xhigh' पर सेट है, जो जटिल कार्यों के लिए गहन विश्लेषण करता है। इस डिफ़ॉल्ट सेटिंग के कारण LM Studio की 8,192 tokens की context सीमा जल्दी भर गई।
262,144 tokens की अधिकतम context length के साथ, एक pelican SVG बनाने में 21 मिनट लगे और 22,276 reasoning tokens तथा 3,223 output tokens की खपत हुई। वहीं reasoning बंद करने पर वही काम 137 सेकंड में पूरा हुआ और 3,715 tokens उत्पन्न हुए।
'एक circle का SVG बनाओ' जैसे सरल prompt पर भी मॉडल ने concentric rings, animation और gradient जैसी जटिल विशेषताएँ जोड़ने की योजना बनाई। Willison के अनुसार 'xhigh' डिफ़ॉल्ट consumer hardware के लिए उपयुक्त नहीं है, हालांकि reasoning बंद होने पर मॉडल की गुणवत्ता प्रभावशाली रहती है।