O Inworld TTS gera fala natural e expressiva para narração. Gere vídeos narrados por IA com o fluxo de trabalho de roteiro para vídeo do VideoGen.
Por Inworld AI · TTS 1.5 lançado em maio de 2026 · Elo do Artificial Analysis Speech Arena ~1.236 (julho de 2026)
Prompts reais, saídas reais, geradas com Inworld TTS no VideoGen.
“Malcolm: Narrador suave e autoritário com um timbre profundo e ressonante.”
Gerado com Inworld TTS no VideoGen
“Celeste: Voz feminina polida e refinada para vitrines de produtos de alto padrão.”
Gerado com Inworld TTS no VideoGen
“Rupert: Voz britânica nítida e sofisticada para promoções corporativas.”
Gerado com Inworld TTS no VideoGen
“Deborah: Voz feminina brilhante e articulada para vídeos explicativos e instrucionais.”
Gerado com Inworld TTS no VideoGen
“Hades: Voz de personagem profunda e imponente para narração dramática.”
Gerado com Inworld TTS no VideoGen
“Hélène: Voz feminina francesa calorosa com uma cadência suave e melódica.”
Gerado com Inworld TTS no VideoGen
“Asuka: Voz feminina japonesa brilhante e energética para conteúdo de redes sociais.”
Gerado com Inworld TTS no VideoGen
| Idiomas | 15, incluindo inglês, espanhol, japonês e árabe |
|---|---|
| Modelos | TTS 1.5 Max, Standard e Mini |
| Clonagem de voz | Clonagem instantânea a partir de uma amostra curta |
| Latência | Menos de 250ms para o primeiro áudio (1,5 máx.) |
| Saída | Fala natural e expressiva com alcance emocional |
O nível mais rápido e acessível, criado para rascunhos e iteração rápida.
O padrão equilibrado: boa qualidade de locuções a um custo acessível para o dia a dia.
locuções de qualidade premium para o conteúdo que você publica.
O MAX sempre integra o que há de mais moderno. Inworld TTS faz parte desse conjunto.
Cada nível de qualidade direciona cada solicitação ao melhor modelo com base em nossas avaliações internas, requisitos de conformidade e sua intenção. As solicitações permanecem totalmente em conformidade em todos os níveis: dados confidenciais nunca são roteados para modelos hospedados por adversários estrangeiros, como a China.
Inscreva-se no VideoGen para abrir o playground e o editor de IA.
Cole ou escreva seu roteiro e o VideoGen gera um vídeo totalmente narrado a partir dele.
Escolha um narrador do catálogo de vozes ou clone sua própria voz.
O VideoGen cria o vídeo finalizado com narração, elementos visuais, música e legendas, pronto para exportar.
Desenvolvedores podem gerar locuções através da API do VideoGen com o mesmo roteamento de nível de qualidade que o aplicativo, para que as solicitações alcancem modelos como Inworld TTS sem gerenciar chaves de provedor.
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'
Transforme qualquer roteiro em uma narração natural e expressiva com o modelo de conversão de texto em fala mais bem classificado.
“O VideoGen é incrível para escalar a produção de vídeos e melhorar o tempo de entrega... O processo complexo de edição de vídeo, que poderia levar dias ou meses, agora leva minutos!”


“O VideoGen resolve os maiores desafios da produção de vídeos—complexidade, custo e tempo. Com apenas alguns cliques, qualquer pessoa pode criar vídeos profissionais e livres de direitos autorais.”

“VideoGen é a ferramenta mais subestimada para criadores de conteúdo que desejam produzir conteúdo de alta qualidade no menor tempo possível.”

Cada fluxo de trabalho do VideoGen usa modelos como Inworld TTS automaticamente para criar vídeos completos com visuais, narração, música e legendas.
Faça login para gerar imagens, clipes de vídeo e mais com os modelos que você escolher.