किसी भी टेक्स्ट को सबटाइटल सहित सुनाई देने वाली MP3 बनाएँ
किसी भी स्क्रिप्ट को न्यूरल आवाज़ों वाली MP3 में बदलें और साथ में ऐसे सबटाइटल पाएँ जो मिलीसेकंड तक मेल खाते हैं।
स्क्रिप्ट हमारे अपने रेंडर एंडपॉइंट पर जाती है, हर शब्द के समय के साथ MP3 बनकर लौटती है, और कहीं संग्रहित नहीं होती। डाउनलोड सिर्फ़ इसी इंजन से संभव है।
Enter नया पैराग्राफ़ शुरू करता है, Shift+Enter उसी पैराग्राफ़ में पंक्ति तोड़ता है। हर पैराग्राफ़ की अपनी आवाज़ हो सकती है — संवाद इसी तरह पढ़वाए जाते हैं।
यह कैसे काम करता है
स्क्रिप्ट लाएँ
टाइप करें, चिपकाएँ या कोई .txt, .md, .srt या .vtt छोड़ दें। हर पैराग्राफ़ एक संपादन योग्य ब्लॉक बन जाता है। आते ही कुछ नहीं बनाया जाता।
आवाज़ चुनें
300 से ज़्यादा न्यूरल आवाज़ों को भाषा, क्षेत्र या लिंग से छानें और पूरी स्क्रिप्ट सौंपने से पहले एक नमूना वाक्य सुन लें।
बनवाएँ
हर पैराग्राफ़ अलग से बनता है और इंजन बताता है कि हर शब्द कहाँ पड़ता है। यही तरंग-आकृति और सबटाइटल को चलाता है।
साथ ले जाएँ
जो अभी सुना, ठीक वही ऑडियो MP3 और WAV में, और उन्हीं समयों से बने SRT तथा VTT सबटाइटल।
इंसानों जैसी आवाज़ें
140 क्षेत्रों में 300 से ज़्यादा न्यूरल आवाज़ें, जिनमें बहुभाषी भी हैं — स्क्रिप्ट की भाषा बदलने पर भी उनका स्वर वही रहता है।
सचमुच मेल खाते सबटाइटल
SRT और VTT फ़ाइलें उन्हीं शब्द और वाक्य समयों से बनती हैं जो इंजन उस विशेष रेंडर के लिए लौटाता है — पढ़ने की गति से अंदाज़ा लगाकर नहीं।
हर पैराग्राफ़ की अपनी आवाज़
हर ब्लॉक को अलग आवाज़ दें और एक ही बार में संवाद, साक्षात्कार या कई पात्रों वाली ऑडियोबुक तैयार करें।
लय आपके हाथ में
गति, सुर और तेज़ी पूरी स्क्रिप्ट के लिए तय करें, और जहाँ किसी पंक्ति को अलग अंदाज़ चाहिए वहाँ ब्लॉक दर ब्लॉक बदल दें।
शुरू से किए बिना बदलाव
सातवें पैराग्राफ़ की गलती सुधारिए और सिर्फ़ सातवाँ पैराग्राफ़ दोबारा बनेगा। जो पहले बन चुका है वह ज्यों का त्यों रहता है।
बिना नेटवर्क वाला इंजन
डिवाइस इंजन आपकी स्क्रिप्ट उन्हीं आवाज़ों से पढ़ता है जो आपके सिस्टम में पहले से हैं, बिना कोई अनुरोध भेजे। केवल सुनने के लिए: ब्राउज़र इसे रिकॉर्ड नहीं करने देता।
एक ही रेंडर से वाचन और सबटाइटल
अपनी स्क्रिप्ट लिखें या चिपकाएँ, 300 से ज़्यादा न्यूरल आवाज़ों में से चुनें, और तैयार ऑडियो के साथ उसी रेंडर से बने SRT तथा VTT सबटाइटल ले जाएँ। हर पैराग्राफ़ की अपनी आवाज़, अपनी गति और अपना सुर हो सकता है, और एक पंक्ति बदलने पर सिर्फ़ वही पंक्ति दोबारा बनती है।
ऑडियो कहाँ बनता है, साफ़ शब्दों में
डिवाइस इंजन के साथ सब कुछ इसी टैब में होता है, उन्हीं आवाज़ों से जो आपके सिस्टम में हैं। न्यूरल इंजन के साथ स्क्रिप्ट हमारे अपने एंडपॉइंट पर जाती है, वहाँ बनती है और सीधे लौट आती है: बीच में कोई तीसरा रिले नहीं, किसी डेटाबेस में कुछ नहीं लिखा जाता, और जवाब भेजने के बाद कोई प्रति नहीं रखी जाती। यही अकेला हिस्सा स्थानीय नहीं है, और यही डाउनलोड तथा सबटाइटल को संभव बनाता है।
वाचन, पढ़ाई और प्रकाशन के लिए
किसी वीडियो पर आवाज़ चढ़ाएँ और उसके सबटाइटल सीधे टाइमलाइन पर रख दें। लंबे लेख को सफ़र के लिए ऑडियो में बदलें। किसी कोर्स को आवाज़ दें — पाठ के लिए एक आवाज़, उदाहरणों के लिए दूसरी। अपनी लिखावट कान से जाँचें; इससे वे भद्दे वाक्य पकड़ में आते हैं जो कोई वर्तनी जाँच नहीं पकड़ती। और ऑडियो तैयार होने पर सबटाइटल बिना डाउनलोड किए सीधे सबटाइटल टूल को भेज दें।
आपकी स्क्रिप्ट, इतिहास और सेटिंग्स इसी ब्राउज़र में रहती हैं, और कहीं नहीं। न्यूरल इंजन को केवल वही पैराग्राफ़ मिलता है जो उसे बोलना है, और जवाब देने के बाद वह कुछ नहीं रखता। न कोई खाता है, न आपके टेक्स्ट पर कोई विश्लेषण, न इसका कोई रिकॉर्ड कि आपने क्या पढ़वाया।
अक्सर पूछे जाने वाले सवाल
Qक्या मैं ऑडियो डाउनलोड कर सकता हूँ, और क्या वह वही है जो मैंने सुना?+
हाँ। MP3 इंजन की बनाई हुई असली धारा है, पैराग्राफ़ दर पैराग्राफ़ जोड़ी गई और बिना दोबारा एन्कोड किए — यानी वही जो प्लेयर ने अभी बजाया। WAV वही ऑडियो बिना संपीड़न के है, उन संपादकों के लिए जिन्हें यह अधिक सुविधाजनक लगता है।
Qक्या सबटाइटल सचमुच ऑडियो से मेल खाते हैं?+
हाँ, क्योंकि वे अंदाज़े से नहीं बनते। बनाते समय इंजन बताता है कि हर शब्द और हर वाक्य ठीक किस क्षण शुरू होता है और कितनी देर चलता है। SRT और VTT उन्हीं आँकड़ों से बनते हैं, इसलिए पढ़ने की गति बदलने पर भी वे सही बने रहते हैं।
Qक्या मेरा टेक्स्ट ब्राउज़र से बाहर जाता है?+
डिवाइस की आवाज़ों के साथ कभी नहीं। न्यूरल आवाज़ों के साथ जो पैराग्राफ़ बोला जाना है वही हमारे अपने एंडपॉइंट पर जाता है, जो ऑडियो लौटाकर कुछ नहीं रखता। ईमानदार जवाब यही है: सैकड़ों मेगाबाइट का मॉडल डाउनलोड किए बिना न्यूरल आवाज़ें किसी टैब में नहीं समातीं।
Qक्या लंबाई की कोई सीमा है?+
हर पैराग्राफ़ की सीमा 3,000 अक्षर है, यानी लगभग एक पन्ना; इससे लंबा आयात अपने आप वाक्य की सीमाओं पर बँट जाता है। पूरी स्क्रिप्ट की कोई सीमा नहीं, पर बहुत लंबी स्क्रिप्ट का मतलब है कई अनुरोध और उसी अनुपात में अधिक समय।
Qक्या एक ही स्क्रिप्ट में कई आवाज़ें इस्तेमाल हो सकती हैं?+
हाँ, इसी के लिए वह पैराग्राफ़ों में बँटी है। कोई भी ब्लॉक खोलिए और उसे उसकी अपनी आवाज़, गति, सुर या तेज़ी दीजिए। जो आप नहीं बदलते वह पूरी स्क्रिप्ट के डिफ़ॉल्ट का पालन करता रहता है।
Qअगर मैं कोई गलती सुधारूँ तो क्या सब कुछ दोबारा बनेगा?+
नहीं। हर पैराग्राफ़ को याद रहता है कि वह किस टेक्स्ट और किन सेटिंग्स से बना था, इसलिए संपादन के बाद सिर्फ़ वही दोबारा भेजे जाते हैं जो सचमुच बदले हैं। लंबे वाचन में यही कुछ सेकंड और कई मिनट का फ़र्क है।
Qडिवाइस की आवाज़ें हर कंप्यूटर पर अलग क्यों लगती हैं?+
क्योंकि वे ऑपरेटिंग सिस्टम की हैं, हमारी नहीं: Windows, macOS, Android, iOS और ChromeOS अपना-अपना सेट लाते हैं। भाषा पैकेज स्थापित करने से इस सूची में और आवाज़ें जुड़ती हैं। न्यूरल आवाज़ें, इसके उलट, हर जगह एक जैसी लगती हैं।