Mistral ने एक ओपन-सोर्स स्पीच जनरेशन मॉडल जारी किया है, जिसके बारे में दावा है कि यह स्मार्टवॉच और स्मार्टफोन जैसे छोटे डिवाइस पर भी चल सकता है। कॉम्पैक्ट पर सक्षम लैंग्वेज मॉडल के लिए जानी जाने वाली इस फ्रेंच AI कंपनी का ऑन-डिवाइस स्पीच सिंथेसिस को लेकर यह एक साहसिक दावा है, जो क्लाउड-बेस्ड वॉयस सर्विसेज की जरूरत ही खत्म कर सकता है। डिटेल अभी बहुत कम हैं, Mistral ने न तो तकनीकी स्पेसिफिकेशन जारी किए हैं, न मॉडल का साइज, न ही बेंचमार्क तुलना।
यह इसलिए मायने रखता है क्योंकि स्पीच जनरेशन पर अब तक Google, Amazon और OpenAI जैसी क्लाउड सर्विसेज का दबदबा रहा है। लोकल स्तर पर अच्छी वॉयस सिंथेसिस चलाने का मतलब है इंटरनेट पर निर्भरता खत्म, जीरो लेटेंसी, और पूरी प्राइवेसी। पर Mistral का एफिशिएंट मॉडल्स का ट्रैक रिकॉर्ड इस दावे को विश्वसनीयता देता है। उनके 7B पैरामीटर लैंग्वेज मॉडल अपने आकार से कहीं बेहतर परफॉर्म करते हैं, और उन्होंने लगातार कंज्यूमर हार्डवेयर पर इन्फरेंस चलाने के वादे पूरे किए हैं।
दूसरे सोर्स से कवरेज न मिलना अपने आप में बहुत कुछ बताता है। या तो यह एक शांत रिलीज है जिसे अभी तवज्जो नहीं मिली, या फिर Mistral जानबूझकर क्षमताओं के बारे में अस्पष्ट बना हुआ है। न कोई बेंचमार्क, न कोई ऑडियो सैंपल, न कोई तकनीकी पेपर, बस यह दावा कि यह स्मार्टवॉच पर चलता है। यह या तो शानदार इंजीनियरिंग है, या फिर मार्केटिंग हकीकत से आगे निकल गई है।
डेवलपर्स के लिए, अगर यह दावे पर खरा उतरता है तो यह बहुत बड़ी बात हो सकती है। लोकल स्पीच जनरेशन ऑफलाइन वॉयस ऐप्स के रास्ते खोलती है, API लागत घटाती है, और प्राइवेसी की चिंताएं खत्म करती है। पर अपने प्रोडक्ट पर दांव लगाने से पहले असली बेंचमार्क और ऑडियो क्वालिटी टेस्ट का इंतजार करें। Mistral ने अपने लैंग्वेज मॉडल से भरोसा कमाया है, पर स्पीच बिल्कुल अलग चुनौती है।
