Inworld TTS genera un parlato naturale ed espressivo per la narrazione. Crea video narrati dall'IA con il flusso di lavoro da sceneggiatura a video di VideoGen.
Di Inworld AI · TTS 1.5 rilasciato a maggio 2026 · Artificial Analysis Speech Arena Elo ~1.236 (luglio 2026)
Prompt reali, output reali, generati con Inworld TTS in VideoGen.
“Malcolm: Narratore fluido e autorevole con un timbro profondo e risonante.”
Generado con Inworld TTS en VideoGen
“Celeste: voce femminile raffinata e ricercata per presentazioni di prodotti di alta gamma.”
Generado con Inworld TTS en VideoGen
“Rupert: Voce britannica nitida e sofisticata per promozioni aziendali.”
Generado con Inworld TTS en VideoGen
“Deborah: voce femminile brillante e articolata per video esplicativi e formativi.”
Generado con Inworld TTS en VideoGen
“Hades: Voce profonda e imponente per narrazioni drammatiche.”
Generado con Inworld TTS en VideoGen
“Hélène: Voce femminile francese calda con una cadenza fluida e melodica.”
Generado con Inworld TTS en VideoGen
“Asuka: voce femminile giapponese brillante ed energica per contenuti sui social media.”
Generado con Inworld TTS en VideoGen
| Lingue | 15, inclusi inglese, spagnolo, giapponese e arabo |
|---|---|
| Modelli | TTS 1.5 Max, Standard e Mini |
| Clonazione vocale | Clonazione istantanea da un breve campione |
| Latenza | Sotto i 250ms per il primo audio (1,5 max) |
| Output | Parlato naturale ed espressivo con gamma emotiva |
Il piano più veloce e conveniente, pensato per bozze e iterazioni rapide.
L'impostazione predefinita equilibrata: voci fuori campo di buona qualità a un costo accessibile.
voci fuori campo di qualità premium per i contenuti che pubblichi.
MAX integra sempre lo stato dell'arte. Inworld TTS fa parte di quell'insieme.
Ogni livello di qualità instrada ogni richiesta verso il modello migliore in base alle nostre valutazioni interne, ai requisiti di conformità e al tuo intento. Le richieste rimangono pienamente conformi a qualsiasi livello: i dati sensibili non vengono mai inviati a modelli ospitati da avversari stranieri come la Cina.
Iscriviti a VideoGen per aprire il playground e l'editor AI.
Incolla o scrivi la tua sceneggiatura e VideoGen ne genererà un video completamente narrato.
Scegli un narratore dal catalogo voci o clona la tua voce.
VideoGen crea el vídeo finalizado con narración, imágenes, música y subtítulos, listo para exportar.
Gli sviluppatori possono generare voci fuori campo tramite l'API VideoGen con lo stesso instradamento dei livelli di qualità dell'app, in modo che le richieste raggiungano modelli come Inworld TTS senza dover gestire le chiavi dei provider.
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'Scopri di più sull'API VideoGen Leggi la documentazione delle API

Trasforma qualsiasi script in una narrazione naturale ed espressiva con il modello text-to-speech più quotato.
“VideoGen è fantastico per scalare la produzione video e migliorare i tempi di consegna... Il complesso processo di montaggio video, che poteva richiedere giorni o mesi, ora richiede solo pochi minuti!”


“VideoGen risolve i principali punti dolenti della produzione video: complessità, costi e tempi. In pochi clic, chiunque può creare video professionali e privi di copyright.”

“VideoGen è lo strumento più sottovalutato per i creatori di contenuti che vogliono produrre contenuti di altissima qualità nel minor tempo possibile.”

Ogni workflow di VideoGen utilizza automaticamente modelli come Inworld TTS per creare video completi con elementi visivi, narrazione, musica e sottotitoli.
Accedi per generare immagini, clip video e altro con i modelli che scegli.