ElevenLabs veröffentlicht Sprachmodell Eleven v4 - über 90 Sprachen und Stimmklon aus 10 Sekunden Aufnahme
ElevenLabs hat Eleven v4 veröffentlicht, ein neues Text-to-Speech-Modell, sowie die schnellere Variante v4 Turbo für Sprachagenten, deren Zeit bis zum Sprechbeginn laut dem Unternehmen bei ca. 150 Millisekunden (Median) liegt. Beide Modelle unterstützen über 90 Sprachen, gegenüber 70 in der Vorgängerversion, und zum Klonen einer Stimme genügen 10 Sekunden Aufnahme. Die Modelle sind bereits in den Diensten von ElevenLabs und über die API verfügbar.