Meta का नया AI सुनेगा 5 भारतीय भाषाएं, ‘Muse Voice Transcribe’ हुआ लॉन्च

Meta का नया AI सुनेगा 5 भारतीय भाषाएं, ‘Muse Voice Transcribe’ हुआ लॉन्च

नई दिल्ली। टेक्नोलॉजी कंपनी Meta ने आर्टिफिशियल इंटेलिजेंस के क्षेत्र में एक नया कदम उठाते हुए Muse Voice Transcribe लॉन्च किया है। यह Meta Superintelligence Labs की ओर से विकसित किया गया पहला रियल-टाइम ऑडियो परसेप्शन मॉडल है। खास बात यह है कि मॉडल में पांच प्रमुख भारतीय भाषाओं के लिए नेटिव सपोर्ट दिया गया है।

पांच भारतीय भाषाओं में करेगा काम

Muse Voice Transcribe हिंदी, तमिल, तेलुगु, मलयालम और कन्नड़ को सपोर्ट करता है। इसके अलावा मॉडल को 70 से अधिक भाषाओं के ऑडियो डेटा पर प्रशिक्षित किया गया है और लॉन्च के समय 25 से ज्यादा भाषाओं में इसकी क्षमताओं को मान्य किया गया है।

इसका सबसे बड़ा फायदा उन लोगों को मिल सकता है जो बातचीत के दौरान एक से ज्यादा भाषाओं का इस्तेमाल करते हैं। मॉडल multilingual code-switching को भी संभाल सकता है, यानी बातचीत के बीच भाषा बदलने पर भी आवाज को पहचानकर उसका ट्रांसक्रिप्शन जारी रख सकता है।

बोलते ही मिलेगा ट्रांसक्रिप्शन

Muse Voice Transcribe को खास तौर पर रियल-टाइम स्पीच-टू-टेक्स्ट के लिए तैयार किया गया है। यानी किसी व्यक्ति के बोलने के दौरान ही उसकी आवाज को टेक्स्ट में बदला जा सकता है। Meta के अनुसार मॉडल में streaming ASR के साथ speaker diarization और endpointing जैसी क्षमताएं भी हैं।

Speaker diarization की मदद से मॉडल एक ही रिकॉर्डिंग में अलग-अलग लोगों की आवाजों को पहचानने में सक्षम है। Meta के अनुसार यह 20 से ज्यादा वक्ताओं वाली बातचीत को भी संभाल सकता है। लंबे ऑडियो और जटिल बातचीत के लिए भी इसे डिजाइन किया गया है।

भारतीय यूजर्स के लिए क्यों अहम?

भारत में एक ही बातचीत में हिंदी और अंग्रेजी या दूसरी क्षेत्रीय भाषाओं का इस्तेमाल आम है। ऐसे में ऐसा AI मॉडल, जो अलग-अलग भाषाओं के बीच तेजी से स्विच कर सके, मीटिंग, इंटरव्यू, कस्टमर सर्विस, पत्रकारिता और दूसरे ऑडियो आधारित कामों में उपयोगी साबित हो सकता है।

खास तौर पर भारतीय भाषाओं के लिए सपोर्ट बढ़ने से क्षेत्रीय भाषा बोलने वाले यूजर्स के लिए AI आधारित transcription सेवाओं की उपयोगिता बढ़ सकती है।

Meta AI में भी होगा इस्तेमाल

Muse Voice Transcribe को Meta के नए AI इकोसिस्टम का हिस्सा बनाया जा रहा है। रिपोर्ट के अनुसार इसे Meta AI for Mac और Muse Code में इस्तेमाल किया जा रहा है और Meta की Model API के जरिए भी इसकी पहुंच उपलब्ध कराई गई है।

Meta का यह कदम ऐसे समय में आया है जब कंपनी अपने Muse परिवार के AI मॉडलों का विस्तार कर रही है। इससे पहले कंपनी ने Muse Spark को अपने नए मल्टीमॉडल AI मॉडल के रूप में पेश किया था, जबकि Muse Image को इमेज जनरेशन के लिए लॉन्च किया गया।

AI की रफ्तार और सटीकता पर जोर

Meta के मुताबिक Muse Voice Transcribe को इस तरह तैयार किया गया है कि यह ऑडियो को तेजी से प्रोसेस करने के साथ-साथ कठिन शब्दों और संदर्भ के हिसाब से अपनी प्रोसेसिंग को एडजस्ट कर सके। इसमें भाषा, keywords और context के आधार पर accuracy बेहतर करने की सुविधाएं भी दी गई हैं।

Meta ने दावा किया है कि लॉन्च के समय Muse Voice Transcribe ने Artificial Analysis के streaming speech-to-text leaderboard में पहला स्थान हासिल किया था। हालांकि ऐसे benchmark परिणाम समय के साथ बदल सकते हैं और अलग-अलग टेस्टिंग परिस्थितियों में प्रदर्शन अलग हो सकता है।

AI की दुनिया में Meta की नई रणनीति

Muse Voice Transcribe की लॉन्चिंग से साफ है कि Meta अब केवल text-based AI तक सीमित नहीं रहना चाहती। कंपनी आवाज, टेक्स्ट, तस्वीर और अन्य माध्यमों को एक साथ समझने वाले AI सिस्टम विकसित कर रही है।

भारतीय भाषाओं को इस नए मॉडल में जगह मिलना भारत जैसे बहुभाषी देश के लिए खास महत्व रखता है। आने वाले समय में यदि ऐसे AI मॉडल क्षेत्रीय भाषाओं में और बेहतर प्रदर्शन करते हैं, तो शिक्षा, मीडिया, व्यवसाय और डिजिटल सेवाओं में इनके इस्तेमाल का दायरा तेजी से बढ़ सकता है।

CATEGORIES
Share This

COMMENTS

Wordpress (0)