Sprachmodelle
VocalLab bietet vier Sprachmodelle. Sie verwenden dieselben Stimmen — was sich unterscheidet, sind Ausdruckskraft, Sprachabdeckung, Geschwindigkeit und Kosten. Du wählst das Modell im Generator (Stimmeinstellungen → Modell), und es gilt für diese Generierung.
Die vier Modelle
| Modell | Am besten für | Sprachen | Steuerbar | Punktkosten |
|---|---|---|---|---|
| VocalLab Studio | Ausdrucksstarke, gelenkte Wiedergabe; seltenere Sprachen | 200+ | ✅ Ja | 1× |
| VocalLab Studio Flash | Hohes Volumen und schnelle Lieferung, gleiche Sprachabdeckung | 200+ | ❌ Nein | ¾ |
| VocalLab Pro (Standard) | Die hochwertigste Wiedergabe in den Kernsprachen | 15 | ❌ Nein | 1× |
| VocalLab Lite | Schnelle Entwürfe, Massen- und Langforminhalte mit kleinem Budget | 15 | ❌ Nein | ½ |
- VocalLab Studio — unser neuestes Modell. Es ist steuerbar: Es folgt Performance-Anweisungen in einfacher Sprache wie
[say quietly in a low tone]und nonverbalen Tags wie[laugh](siehe Voice Steering). Es deckt außerdem 200+ Sprachen und Regionalvarianten ab, daher ist es das Modell für alles außerhalb der 15 Kernsprachen. - VocalLab Studio Flash — dieselbe Modellgeneration wie Studio, auf Geschwindigkeit ausgelegt: etwa 5× schneller beim Sprechbeginn, zu ¾ der Punkte. Es teilt sich Studios 200+ Sprachen, funktioniert mit Instant Voice Cloning und liest weiterhin nonverbale Tags wie
[laugh]. Was es nicht kann: Steuerungsanweisungen befolgen — für eine gelenkte Performance nimm Studio. - VocalLab Pro — der Standard. Optimiert für die natürlichste, hochwertigste Wiedergabe über die 15 Kernsprachen hinweg. Es folgt keinen Steuerungsanweisungen — diese werden wörtlich vorgelesen, verwende daher Studio, wenn du die Performance lenken möchtest.
- VocalLab Lite — ein leichteres, schnelleres Modell, das die Hälfte der Punkte kostet. Ideal für erste Entwürfe, umfangreiche Aufträge und Langform-Audio, bei denen das Budget zählt.
Welches sollte ich verwenden?
- Du möchtest Emotion, Betonung oder eine bestimmte Wiedergabe? → VocalLab Studio.
- Du generierst in einer Sprache, die nicht zu den 15 Kernsprachen gehört? → VocalLab Studio (nur es deckt 200+ ab).
- Du generierst viel in einer Nicht-Kernsprache oder brauchst es schnell? → VocalLab Studio Flash.
- Du möchtest die sauberste, natürlichste Standardwiedergabe? → VocalLab Pro.
- Du generierst viel oder erstellst Entwürfe und möchtest Punkte sparen? → VocalLab Lite.
Verfügbarkeit & Kosten
- VocalLab Pro, VocalLab Studio Flash und VocalLab Lite sind in jedem Tarif verfügbar.
- VocalLab Studio ist in den Tarifen Pro (24 $/Monat) und Studio (99 $/Monat) enthalten. In den Tarifen Free und Lite erscheint es gesperrt mit einer Upgrade-Aufforderung.
- VocalLab Studio Flash wird mit ¾ und VocalLab Lite mit der Hälfte der Punkte von Studio und Pro abgerechnet. Die Kosten richten sich immer nach der Textlänge — siehe Credits & Minuten.
In der API & den KI-Tools
Die API und der MCP-Server können alle vier Modelle nutzen (ein API-Schlüssel ist eine Funktion des Studio-Tarifs). Übergib ein model an POST /api/v1/tts — eines von v-studio, v-flash, v-pro (Standard) oder v-lite — oder rufe GET /api/v1/models auf, um sie aufzulisten. Siehe API-Referenz und MCP-Server.


