Inworld TTS genera voz natural y expresiva para narración. Genera videos narrados por IA con el flujo de trabajo de guion a video de VideoGen.
Por Inworld AI · TTS 1.5 lanzado en mayo de 2026 · Elo en la Speech Arena de Artificial Analysis ~1,236 (julio de 2026)
Prompts reales, resultados reales, generados con Inworld TTS en VideoGen.
“Malcolm: Narrador suave y autoritario con un timbre profundo y resonante.”
Generado con Inworld TTS en VideoGen
“Celeste: Voz femenina pulida y refinada para presentaciones de productos de alta gama.”
Generado con Inworld TTS en VideoGen
“Rupert: voz británica nítida y sofisticada para promociones corporativas.”
Generado con Inworld TTS en VideoGen
“Deborah: Voz femenina brillante y articulada para videos explicativos e instructivos.”
Generado con Inworld TTS en VideoGen
“Hades: Voz de personaje profunda y dominante para narración dramática.”
Generado con Inworld TTS en VideoGen
“Hélène: Voz femenina francesa cálida con una cadencia suave y melódica.”
Generado con Inworld TTS en VideoGen
“Asuka: Voz femenina japonesa brillante y enérgica para contenido de redes sociales.”
Generado con Inworld TTS en VideoGen
| Idiomas | 15, incluyendo inglés, español, japonés y árabe |
|---|---|
| Modelos | TTS 1.5 Max, Standard y Mini |
| Clonación de voz | Clonación instantánea a partir de una muestra corta |
| Latencia | Menos de 250 ms hasta el primer audio (1.5 máx.) |
| Resultado | Voz natural y expresiva con rango emocional |
El nivel más rápido y asequible, diseñado para borradores e iteraciones rápidas.
La opción predeterminada equilibrada: buena calidad de locuciones a un coste asequible para el día a día.
locuciones de calidad premium para el contenido que publicas.
MAX siempre integra lo último en tecnología. Inworld TTS forma parte de ese conjunto.
Cada nivel de calidad dirige cada solicitud al mejor modelo basándose en nuestras evaluaciones internas, requisitos de cumplimiento y tu intención. Las solicitudes permanecen totalmente conformes en cada nivel: los datos confidenciales nunca se envían a modelos alojados por adversarios extranjeros como China.
Regístrate en VideoGen para acceder al área de juegos y al editor de IA.
Pega o escribe tu guion y VideoGen generará un vídeo totalmente narrado a partir de él.
Elige un narrador del catálogo de voces, o clona tu propia voz.
VideoGen construye el video terminado con narración, efectos visuales, música y subtítulos, listo para exportar.
Los desarrolladores pueden generar locuciones a través de la API de VideoGen con el mismo enrutamiento de nivel de calidad que la aplicación, de modo que las solicitudes lleguen a modelos como Inworld TTS sin gestionar las claves del proveedor.
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'Más información sobre la API VideoGen Leer la documentación de la API

Convierte cualquier guion en una narración natural y expresiva con el modelo de texto a voz mejor valorado.
“VideoGen es increíble para escalar la producción de videos y mejorar los tiempos de entrega... ¡El complejo proceso de edición de video, que antes podía tomar días o meses, ahora toma minutos!”


“VideoGen resuelve los mayores problemas de la producción de videos: la complejidad, el costo y el tiempo. En solo unos pocos clics, cualquiera puede crear videos profesionales y libres de derechos de autor.”

“VideoGen es la herramienta más subestimada para los creadores de contenido que quieren producir contenido de la más alta calidad en el menor tiempo posible.”

Cada flujo de trabajo de VideoGen utiliza modelos como Inworld TTS automáticamente para crear vídeos completos con efectos visuales, narración, música y subtítulos.
Inicia sesión para generar imágenes, clips de video y más con los modelos que elijas.