- क्या यह Panopto, Echo360, Canvas और YouTube के साथ चलता है?
-
सभी। यह किसी प्लैटफ़ॉर्म से जुड़ने के बजाय ऐप की निकाली आवाज़ पकड़ता है, इसलिए Panopto में कोई लेक्चर, Echo360 की कोई रिकॉर्डिंग, Zoom का कोई सेमिनार, YouTube की कोई रिकॉर्डिंग और Canvas में लगा कोई वीडियो, इसके लिए सब एक ही चीज़ हैं: आपके Mac से निकलती आवाज़।
- क्या यह तकनीकी शब्द ठीक लिखेगा?
-
अक्सर नहीं, और कोई भी स्पीच रिकग्नाइज़र नहीं करेगा। यूनिवर्सिटी ख़ुद अपनी गाइड में ऑटोमैटिक कैप्शन के बारे में यही कहती हैं: उच्चारण वाली बोली और विषय के ख़ास शब्दों पर सटीकता गिरती है। यह उस वाक्य में मदद करता है जो आपने आधा सुना, उस शब्द में नहीं जो मॉडल ने कभी देखा ही नहीं। नाम, संकेत और तकनीकी शब्द आपको ख़ुद ठीक करने होंगे।
- क्या दोहराने के लिए कैप्शन रखे जा सकते हैं?
-
नहीं। यहाँ डिस्क पर कभी कुछ नहीं लिखा जाता। दोहराने के लिए अपने संस्थान की रिकॉर्डिंग और उससे बनने वाला ट्रांसक्रिप्ट इस्तेमाल कीजिए, वह इस काम के लिए बेहतर है और आम तौर पर आपकी फ़ीस में शामिल भी।
- अगर मेरी यूनिवर्सिटी ने कैप्शन चालू ही नहीं किए हैं, तब?
-
तब भी यह चलता है, क्योंकि यह आपकी यूनिवर्सिटी से कुछ पूछता ही नहीं। प्लैटफ़ॉर्म के कैप्शन होंगे या नहीं, यह किसी संस्थागत सेटिंग और किसी कॉन्फ़िडेंस थ्रेशोल्ड पर टिका है, और इनमें से कुछ भी आप अपनी सीट से नहीं बदल सकते।
- क्या यह लेक्चर हॉल में काम करता है?
-
नहीं, और ख़रीदने से पहले साफ़ कर लेने लायक़ बात यही है। यह उस ऑडियो का कैप्शन बनाता है जो आपका Mac चला रहा है और माइक्रोफ़ोन कभी नहीं खोलता, इसलिए कमरे में बोलता कोई लेक्चरर इसे सुनाई ही नहीं देता। यह उन लेक्चर के लिए है जिन्हें आप स्ट्रीम करते हैं, जिनमें जुड़ते हैं या जिन्हें चलाकर देखते हैं।
- लेक्चर के लिए कौन सा मॉडल इस्तेमाल करूँ?
-
इनमें से कोई धीमा वाला। बातचीत में आपको 160 ms वाला मॉडल चाहिए, क्योंकि आपको जवाब भी देना है; लेक्चर में आपको किसी को जवाब नहीं देना, इसलिए लेटेंसी देकर सटीकता ले लीजिए और 1120 या 2240 ms वाला Nemotron इस्तेमाल कीजिए, जो विराम चिह्न और बड़े अक्षर भी लगाता है।