Inworld TTS genererar naturligt, uttrycksfullt tal för berättarröst. Skapa AI-berättade videor med VideoGens arbetsflöde för manus-till-video.
Av Inworld AI · TTS 1.5 släpptes maj 2026 · Artificial Analysis Speech Arena Elo ~1 236 (juli 2026)
Riktiga prompter, riktiga resultat, genererade med Inworld TTS i VideoGen.
“Malcolm: Mjuk, auktoritativ berättare med en djup, resonant klangfärg.”
Genererad med Inworld TTS i VideoGen
“Celeste: Polerad, sofistikerad kvinnoröst för exklusiva produktpresentationer.”
Genererad med Inworld TTS i VideoGen
“Rupert: Krispig, sofistikerad brittisk röst för företagsreklam.”
Genererad med Inworld TTS i VideoGen
“Deborah: Ljus, tydlig kvinnoröst för förklaringsvideor och instruktionsfilmer.”
Genererad med Inworld TTS i VideoGen
“Hades: Auktoritär, djup karaktärsröst för dramatisk berättarröst.”
Genererad med Inworld TTS i VideoGen
“Hélène: Varm fransk kvinnoröst med en mjuk, melodisk kadens.”
Genererad med Inworld TTS i VideoGen
“Asuka: Ljus, energisk japansk kvinnoröst för innehåll i sociala medier.”
Genererad med Inworld TTS i VideoGen
| Språk | 15, inklusive engelska, spanska, japanska och arabiska |
|---|---|
| Modeller | TTS 1.5 Max, Standard och Mini |
| Röstkloning | Omedelbar kloning från ett kort prov |
| Latens | Under 250ms till första ljudet (1,5 max) |
| Utdata | Naturligt, uttrycksfullt tal med emotionell bredd |
Den snabbaste och mest prisvärda nivån, byggd för utkast och snabb iteration.
Den balanserade standardinställningen: bra kvalitet på voiceovers till en vardaglig kostnad.
Premiumkvalitet på voiceovers för innehållet du publicerar.
MAX integrerar alltid det senaste inom tekniken. Inworld TTS är en del av den uppsättningen.
Varje kvalitetsnivå dirigerar varje förfrågan till den bästa modellen baserat på våra interna utvärderingar, efterlevnadskrav och ditt syfte. Förfrågningar förblir helt följsamma på varje nivå: känslig data skickas aldrig till modeller som hostas av utländska motståndare som Kina.
Registrera dig för VideoGen för att öppna AI-lekplatsen och redigeraren.
Klistra in eller skriv ditt manus så genererar VideoGen en färdigberättad video baserad på det.
Välj en berättarröst från röstkatalogen, eller klona din egen röst.
VideoGen skapar den färdiga videon med berättarröst, grafik, musik och undertexter, redo att exporteras.
Utvecklare kan generera voiceovers via VideoGen-API:et med samma rutt för kvalitetsnivå som i appen, så att förfrågningar når modeller som Inworld TTS utan att behöva hantera leverantörsnycklar.
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'
Omvandla vilket manus som helst till naturligt, uttrycksfullt tal med den högst rankade text-till-tal-modellen.
“VideoGen är fantastiskt för att skala upp videoproduktion och förbättra leveranstiden... Den komplexa processen med videoredigering, som kunde ta dagar eller månader, tar nu bara några minuter!”


“VideoGen löser de största problemområdena inom videoproduktion—komplexitet, kostnad och tid. Med bara några klick kan vem som helst skapa professionella, upphovsrättsfria videor.”

“VideoGen är det mest underskattade verktyget för innehållsskapare som vill producera det högsta kvalitetsinnehållet på kortast möjliga tid.”

Varje VideoGen-arbetsflöde använder modeller som Inworld TTS automatiskt för att bygga kompletta videor med grafik, berättarröst, musik och undertexter.
Logga in för att generera bilder, videoklipp och mer med de modeller du väljer.