Inworld TTS menghasilkan ucapan yang alami dan ekspresif untuk narasi. Buat video dengan narasi AI menggunakan alur kerja ubah naskah menjadi video di VideoGen.
Oleh Inworld AI · TTS 1.5 dirilis Mei 2026 · Artificial Analysis Speech Arena Elo ~1.236 (Juli 2026)
Prompt nyata, output nyata, dihasilkan dengan Inworld TTS di VideoGen.
“Malcolm: Narator yang halus dan berwibawa dengan timbre yang dalam dan bergema.”
Dihasilkan dengan Inworld TTS di VideoGen
“Celeste: Suara wanita yang halus dan elegan untuk etalase produk kelas atas.”
Dihasilkan dengan Inworld TTS di VideoGen
“Rupert: Suara Inggris yang tajam dan canggih untuk promosi perusahaan.”
Dihasilkan dengan Inworld TTS di VideoGen
“Deborah: Suara wanita yang ceria dan jelas untuk video penjelasan dan instruksional.”
Dihasilkan dengan Inworld TTS di VideoGen
“Hades: Suara karakter yang dalam dan berwibawa untuk narasi dramatis.”
Dihasilkan dengan Inworld TTS di VideoGen
“Hélène: Suara wanita Prancis yang hangat dengan irama yang halus dan merdu.”
Dihasilkan dengan Inworld TTS di VideoGen
“Asuka: Suara wanita Jepang yang ceria dan energik untuk konten media sosial.”
Dihasilkan dengan Inworld TTS di VideoGen
| Bahasa | 15, termasuk Inggris, Spanyol, Jepang, dan Arab |
|---|---|
| Model | TTS 1.5 Max, Standard, dan Mini |
| Kloning suara | Kloning instan dari sampel pendek |
| Latensi | Di bawah 250md ke audio pertama (Maksimal 1,5 detik) |
| Hasil | Ucapan yang natural dan ekspresif dengan rentang emosional |
Tingkat tercepat dan paling terjangkau, dibuat untuk draf dan iterasi cepat.
Default seimbang: pengisi suara berkualitas baik dengan biaya sehari-hari.
pengisi suara kualitas premium untuk konten yang Anda publikasikan.
MAX selalu mengintegrasikan teknologi terkini. Inworld TTS adalah bagian dari rangkaian tersebut.
Setiap tingkatan kualitas mengarahkan setiap permintaan ke model terbaik berdasarkan evaluasi internal, persyaratan kepatuhan, dan niat Anda. Permintaan tetap sepenuhnya patuh di setiap tingkatan: data sensitif tidak pernah diarahkan ke model yang dihosting oleh musuh asing seperti Tiongkok.
Daftar ke VideoGen untuk membuka arena bermain dan editor AI.
Tempel atau tulis naskah Anda dan VideoGen akan menghasilkan video lengkap dengan narasi darinya.
Pilih narator dari katalog suara, atau kloning suara Anda sendiri.
VideoGen menyusun video jadi lengkap dengan narasi, visual, musik, dan keterangan, siap untuk diekspor.
Pengembang dapat membuat pengisi suara melalui API VideoGen dengan perutean tingkat kualitas yang sama seperti aplikasi, sehingga permintaan mencapai model seperti Inworld TTS tanpa harus mengelola kunci penyedia.
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'Pelajari lebih lanjut tentang VideoGen API Baca dokumentasi API

Ubah naskah apa pun menjadi narasi yang alami dan ekspresif dengan model teks-ke-ucapan peringkat teratas.
“VideoGen luar biasa untuk meningkatkan produksi video dan mempercepat waktu penyelesaian... Proses pengeditan video yang rumit, yang biasanya memakan waktu berhari-hari atau berbulan-bulan, kini hanya membutuhkan beberapa menit!”


“VideoGen memecahkan masalah terbesar dalam produksi video—kompleksitas, biaya, dan waktu. Hanya dengan beberapa klik, siapa pun dapat membuat video profesional bebas hak cipta.”

“VideoGen adalah alat yang paling diremehkan untuk pembuat konten yang ingin mengeluarkan konten berkualitas tertinggi dalam waktu paling singkat.”

Setiap alur kerja VideoGen menggunakan model seperti Inworld TTS secara otomatis untuk membangun video lengkap dengan visual, narasi, musik, dan takarir.
Masuk untuk menghasilkan gambar, klip video, dan lainnya dengan model yang Anda pilih.