ElevenLabs brachte am Montag Eleven v4 heraus, ein Sprachmodell, das Ton und Gefühl aus dem Text liest. Eine aus zehn Sekunden geklonte Stimme spricht über 90 Sprachen und klingt dabei einheimisch. Die Turbo-Fassung beginnt rund 150 Millisekunden nach der Anfrage zu sprechen.