Inworld TTS कथन के लिए प्राकृतिक, अभिव्यंजक भाषण उत्पन्न करता है। VideoGen के स्क्रिप्ट-टू-वीडियो वर्कफ़्लो के साथ AI द्वारा वर्णित वीडियो उत्पन्न करें।
Inworld AI द्वारा · TTS 1.5 मई 2026 में जारी किया गया · आर्टिफिशियल एनालिसिस स्पीच अरीना Elo ~1,236 (जुलाई 2026)
वास्तविक प्रॉम्प्ट, वास्तविक आउटपुट, VideoGen में Inworld TTS के साथ उत्पन्न।
“मैल्कम: गहरी, गूंजती आवाज वाला एक सहज, आधिकारिक कथावाचक।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
“Celeste: हाई-एंड प्रोडक्ट शोकेस के लिए पॉलिश, परिष्कृत महिला आवाज़।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
“रूपर्ट: कॉर्पोरेट प्रोमो के लिए स्पष्ट, परिष्कृत ब्रिटिश आवाज।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
“Deborah: व्याख्याकार और निर्देशात्मक वीडियो के लिए उज्ज्वल, स्पष्ट महिला आवाज़।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
“हेडीज़: नाटकीय वर्णन के लिए कमांडिंग, गहरा चरित्र आवाज़।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
“हेलेन: एक सहज, मधुर लहजे के साथ गर्म फ्रांसीसी महिला आवाज़।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
“Asuka: सोशल मीडिया सामग्री के लिए उज्ज्वल, ऊर्जावान जापानी महिला आवाज़।”
VideoGen में Inworld TTS के साथ जनरेट किया गया
| भाषाएँ | 15, जिसमें अंग्रेज़ी, स्पैनिश, जापानी और अरबी शामिल हैं |
|---|---|
| मॉडल | TTS 1.5 मैक्स, स्टैंडर्ड, और मिनी |
| वॉइस क्लोनिंग | एक छोटे नमूने से त्वरित क्लोनिंग |
| विलंबता (Latency) | पहली ऑडियो के लिए 250ms से कम (अधिकतम 1.5) |
| आउटपुट | भावनात्मक रेंज के साथ स्वाभाविक, अभिव्यंजक भाषण |
सबसे तेज़ और सबसे किफायती टियर, जिसे ड्राफ्ट और त्वरित पुनरावृत्ति (iteration) के लिए बनाया गया है।
संतुलित डिफ़ॉल्ट: किफायती दैनिक लागत पर अच्छी क्वालिटी का वॉइसओवर्स।
आपके द्वारा प्रकाशित सामग्री के लिए प्रीमियम गुणवत्ता वॉइसओवर्स।
MAX हमेशा अत्याधुनिक तकनीक को एकीकृत करता है। Inworld TTS उस सेट का हिस्सा है।
हर गुणवत्ता स्तर हमारे आंतरिक मूल्यांकन, अनुपालन आवश्यकताओं और आपके उद्देश्य के आधार पर प्रत्येक अनुरोध को सर्वश्रेष्ठ मॉडल तक पहुँचाता है। अनुरोध हर स्तर पर पूरी तरह से अनुपालन में रहते हैं: संवेदनशील डेटा कभी भी चीन जैसे विदेशी विरोधियों द्वारा होस्ट किए गए मॉडल तक नहीं पहुँचाया जाता है।
AI प्लेग्राउंड और एडिटर खोलने के लिए VideoGen के लिए साइन अप करें।
अपनी स्क्रिप्ट पेस्ट करें या लिखें और VideoGen उससे पूरी तरह से वर्णित वीडियो तैयार करेगा।
वॉयस कैटलॉग से एक नैरेटर चुनें, या अपनी खुद की आवाज़ क्लोन करें।
VideoGen वीडियो को नरेशन, विजुअल्स, म्यूजिक और कैप्शन के साथ तैयार करता है, जिसे एक्सपोर्ट किया जा सकता है।
डेवलपर्स ऐप के समान क्वालिटी टियर रूटिंग के साथ वीडियोजेन (VideoGen) एपीआई (API) के माध्यम से वॉइसओवर्स जेनरेट कर सकते हैं, ताकि अनुरोध प्रोवाइडर कुंजियों को प्रबंधित किए बिना Inworld TTS जैसे मॉडल तक पहुँच सकें।
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'
शीर्ष-रैंक वाले टेक्स्ट-टू-स्पीच मॉडल के साथ किसी भी स्क्रिप्ट को स्वाभाविक, अभिव्यंजक कथन में बदलें।
“वीडियो उत्पादन को स्केल करने और टर्नअराउंड समय सुधारने के लिए VideoGen शानदार है... वीडियो एडिटिंग की जटिल प्रक्रिया, जिसमें दिनों या महीनों लग सकते थे, अब मिनटों में पूरी हो जाती है!”


“वीडियोGen वीडियो निर्माण की सबसे बड़ी समस्याओं—जटिलता, लागत, और समय—का समाधान करता है। केवल कुछ क्लिक में, कोई भी प्रोफेशनल और कॉपीराइट-फ्री वीडियो बना सकता है।”

“VideoGen उन सामग्री निर्माताओं के लिए सबसे कम आंकी जाने वाली उपकरण है जो सबसे उच्च गुणवत्ता वाली सामग्री को सबसे कम समय में प्रस्तुत करना चाहते हैं।”

हर VideoGen वर्कफ़्लो स्वचालित रूप से Inworld TTS जैसे मॉडल का उपयोग करके विज़ुअल्स, नरेशन, संगीत और कैप्शन के साथ पूर्ण वीडियो बनाता है।
इन मॉडलों के साथ इमेज, वीडियो क्लिप और अधिक उत्पन्न करने के लिए साइन इन करें, जिन्हें आप चुनते हैं।