Inworld TTS erzeugt natürliche, ausdrucksstarke Sprache für Erzählungen. Erstellen Sie KI-erzählte Videos mit dem Skript-zu-Video-Workflow von VideoGen.
Von Inworld AI · TTS 1.5 veröffentlicht im Mai 2026 · Artificial Analysis Speech Arena Elo ~1.236 (Juli 2026)
Echte Prompts, echte Ergebnisse, generiert mit Inworld TTS in VideoGen.
“Malcolm: Sanfter, autoritärer Erzähler mit einer tiefen, resonanten Klangfarbe.”
Generiert mit Inworld TTS in VideoGen
“Celeste: Gepflegte, kultivierte Frauenstimme für erstklassige Produktpräsentationen.”
Generiert mit Inworld TTS in VideoGen
“Rupert: Klare, kultivierte britische Stimme für Unternehmens-Werbespots.”
Generiert mit Inworld TTS in VideoGen
“Deborah: Helle, artikulierte Frauenstimme für Erklär- und Anleitungsvideos.”
Generiert mit Inworld TTS in VideoGen
“Hades: Gebieterische, tiefe Charakterstimme für dramatische Erzählungen.”
Generiert mit Inworld TTS in VideoGen
“Hélène: Warme französische Frauenstimme mit einem sanften, melodischen Rhythmus.”
Generiert mit Inworld TTS in VideoGen
“Asuka: Helle, energetische japanische Frauenstimme für Social-Media-Inhalte.”
Generiert mit Inworld TTS in VideoGen
| Sprachen | 15, einschließlich Englisch, Spanisch, Japanisch und Arabisch |
|---|---|
| Modelle | TTS 1.5 Max, Standard und Mini |
| Stimmenklonen | Sofortiges Klonen anhand eines kurzen Samples |
| Latenz | Unter 250 ms bis zum ersten Audio (max. 1,5 s) |
| Ausgabe | Natürliche, ausdrucksstarke Sprache mit emotionaler Bandbreite |
Das schnellste und günstigste Paket, entwickelt für Entwürfe und schnelle Iterationen.
Der ausgewogene Standard: Voiceovers in guter Qualität zu alltagstauglichen Kosten.
Premium-Qualität Voiceovers für die Inhalte, die Sie veröffentlichen.
MAX integriert immer den neuesten Stand der Technik. Inworld TTS ist Teil dieses Sets.
Jede Qualitätsstufe leitet jede Anfrage basierend auf unseren internen Bewertungen, Compliance-Anforderungen und Ihrer Absicht an das beste Modell weiter. Anfragen bleiben auf jeder Stufe vollständig konform: Sensible Daten werden niemals an Modelle weitergeleitet, die von ausländischen Gegnern wie China gehostet werden.
Registrieren Sie sich bei VideoGen, um den KI-Spielplatz und -Editor zu öffnen.
Fügen Sie Ihr Skript ein oder schreiben Sie es, und VideoGen erstellt daraus ein vollständig vertontes Video.
Wählen Sie einen Erzähler aus dem Stimmenkatalog oder klonen Sie Ihre eigene Stimme.
VideoGen erstellt das fertige Video mit Sprechertext, visuellen Elementen, Musik und Untertiteln, bereit zum Exportieren.
Entwickler können Voiceovers über die VideoGen API mit demselben Qualitäts-Routing wie in der App generieren, sodass Anfragen Modelle wie Inworld TTS erreichen, ohne Anbieter-Schlüssel verwalten zu müssen.
curl -X POST "https://api.videogen.io/v1/tools/text-to-speech" \
-H "Authorization: Bearer $VIDEOGEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{"ttsText": "Welcome to the future of video.", "voiceId": "<voice id>"}'Erfahren Sie mehr über die VideoGen-API API-Dokumentation lesen

Verwandeln Sie jedes Skript in eine natürliche, ausdrucksstarke Erzählung mit dem erstklassigen Text-zu-Sprache-Modell.
“VideoGen ist großartig, um die Videoproduktion zu skalieren und die Bearbeitungszeit zu verbessern ... Der komplexe Prozess der Videobearbeitung, der Tage oder Monate dauern konnte, dauert jetzt nur noch Minuten!”


“VideoGen löst die größten Schmerzpunkte der Videoproduktion – Komplexität, Kosten und Zeit. Mit nur wenigen Klicks kann jeder professionelle, urheberrechtsfreie Videos erstellen.”

“VideoGen ist das am meisten unterschätzte Werkzeug für Inhaltsersteller, die die hochwertigsten Inhalte in kürzester Zeit erstellen möchten.”

Jeder VideoGen-Workflow verwendet automatisch Modelle wie Inworld TTS, um vollständige Videos mit Bildmaterial, Erzählung, Musik und Untertiteln zu erstellen.
Melde dich an, um Bilder, Videoclips und mehr mit den von dir gewählten Modellen zu generieren.