Google का EmbeddingGemma 2 लॉन्च

मूल शीर्षक: EmbeddingGemma 2: An open, lightweight multimodal embedding model

यह क्यों महत्वपूर्ण है

Open multimodal embedding model on-device AI को सस्ता और cloud-independent बनाता है, जो developers के लिए बड़ा अवसर है।

Google DeepMind ने 6 अक्टूबर 2026 को EmbeddingGemma 2 जारी किया — यह एक open, lightweight multimodal embedding model है जो text, image, audio और video को एक unified embedding space में map करता है।

Google DeepMind के research engineers Sahil Dua और Henrique Schechter Vera ने EmbeddingGemma 2 पेश किया है। कंपनी का दावा है कि यह on-device multimodal embeddings के लिए अब तक का सबसे सक्षम model है। यह model text, images, audio और video के संयोजन को natively एक ही embedding space में ले जाता है, यानी अलग-अलग modality के लिए अलग pipeline की ज़रूरत नहीं। Google ने पिछले साल EmbeddingGemma की पहली पीढ़ी पेश की थी, और यह उसी श्रृंखला का अगला संस्करण है। model को open रखा गया है, जिससे developers इसे अपने applications में सीधे इस्तेमाल कर सकते हैं। lightweight होने के कारण यह on-device deployment के लिए उपयुक्त है, जो cloud पर निर्भरता घटाता है। विस्तृत technical specifications और benchmark numbers अभी तक आधिकारिक blog पर पूरी तरह उपलब्ध नहीं हैं।

स्रोत

blog.google — मूल लेख पढ़ें →