Eleven v4, uvedený 28. září 2026, se zaměřuje na kvalitní a expresivní přednes; v4 Turbo cílí na živé hlasové agenty a podle ElevenLabs dosahuje mediánu latence inference přibližně 100 ms.
PublikovalUpraveno pomocí GPT-6 LunaObrázky vytvořeny pomocí GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What are ElevenLabs’ new Eleven v4 and Eleven v4 Turbo text-to-speech models, how do their availability, architecture, voice cloning, langua. Article summary: ElevenLabs launched Eleven v4 and Eleven v4 Turbo on September 28, 2026: v4 prioritizes expressive, produced speech, while Turbo trades some emphasis on maximum quality for the speed needed by live voice agents. Together. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
ElevenLabs 28. září 2026 představilo dvě varianty nové generace syntézy řeči: Eleven v4 pro expresivní, pečlivě připravený obsah a Eleven v4 Turbo pro aplikace, které potřebují odpovídat v reálném čase. Obě podporují více než 90 jazyků a klonování hlasu, jejich hlavní přednosti se ale liší. A firemní tvrzení o kvalitě či rychlosti nenahradí vlastní testy na vašem obsahu. 5
11
17
| Eleven v4 | Eleven v4 Turbo | |
|---|---|---|
| Pro koho je určený | Pro tvorbu obsahu, audioknihy a hlasové role, u nichž je prioritou kvalita |
Pro použití v reálném čase, například konverzační agenty a interaktivní hlasové služby |
| Na co klade důraz | Na expresivní podání a kontrolu nad přednesem scénáře |
Na nižší latenci při generování řeči |
| Uváděná latence | Dostupné zdroje neuvádějí srovnatelnou hodnotu | Podle ElevenLabs přibližně 100 ms mediánu latence inference a asi 150 ms do začátku řeči |
| Jazyková podpora | Více než 90 jazyků |
Více než 90 jazyků |
| Dostupnost | ElevenAPI, ElevenAgents a ElevenCreative |
ElevenAPI, ElevenAgents a ElevenCreative |
Pokud je pro vás nejdůležitější přednes, emoce a práce se scénářem, začněte s v4. Jestli stavíte hlasovou aplikaci, která musí reagovat svižně, dává větší smysl Turbo. ElevenLabs uvádí, že Turbo si zachovává vysokou kvalitu a zároveň snižuje latenci, dostupné podklady ale neobsahují srovnání kvality modelů pro všechny typy použití. 17
ElevenLabs popisuje v4 jako model s novou architekturou, která má nabídnout lepší kontrolu nad tónem, tempem, emocemi a charakterem projevu. Veřejné materiály k uvedení představují zamýšlené přínosy, neposkytují však dost technických podrobností k nezávislému posouzení samotné architektury. 5
10
Rozšířila se také práce s vloženými zvukovými značkami neboli inline audio tags, jimiž lze modelu napovědět, jak má konkrétní repliku pronést. ElevenLabs je představilo už ve verzi v3; podle TechCrunche v4 umožňuje značky kombinovat a dodržovat jejich pořadí. 5 Scénář tak může obsahovat přesnější pokyny, výsledný přednes je ale stále potřeba zkontrolovat.
Oba nové modely podporují více než 90 jazyků. ElevenLabs uvádí, že okamžitý hlasový klon lze vytvořit už z desetisekundové nahrávky. Ve v4 se vrací také profesionální klonování hlasu, které podle společnosti v3 nepodporovala. 1
5
11
Pro delší texty nabízí ElevenLabs funkci context stitching, která má pomáhat udržet tempo a způsob přednesu napříč scénářem libovolné délky. To může být praktické třeba při výrobě audioknih. Jde však o tvrzení výrobce, nikoli o nezávislý důkaz, že každý hlas zůstane konzistentní v každém projektu. 11
ElevenLabs uvádí u v4 Turbo přibližně 100 ms mediánu latence inference a zhruba 150 ms mediánu do začátku řeči. Jde o dvě různé veličiny: první popisuje latenci inference, druhá čekání na začátek mluveného výstupu. Ani jedna sama o sobě neříká, jak rychle bude působit celá interakce s hlasovým agentem. 11
Živá konverzace závisí i na dalších částech systému: zpracování hlasu volajícího, vytvoření odpovědi agenta a jejím doručení přes síť. Uváděné hodnoty proto berte jako užitečné specifikace modelu, ale odezvu měřte také v aplikaci a prostředí, kde ji chcete nasadit.
Zpráva o uvedení modelu uvádí, že se Eleven v4 umístil na prvním místě žebříčku Provider Voice Arena od Artificial Analysis. Výsledek se týká konkrétního modelu a konkrétního hodnocení; nedokazuje, že v4 vede u každého jazyka, hlasu, dlouhého textu nebo nastavení hlasového agenta. 6 Toto pořadí se navíc nevztahuje automaticky na Turbo: v dostupných informacích nebyl doložen samostatný veřejný benchmark v4 Turbo.
18
Mezi další poskytovatele, kteří se objevují v souvislosti s hlasovými nástroji pro použití v reálném čase, patří Cartesia a Inworld. O to důležitější je přímé srovnání: vyzkoušejte stejné scénáře, síťové podmínky i pracovní postup agenta a nespoléhejte jen na výrobcem uváděnou latenci. 19
Rozdělení nabídky na dvě varianty ukazuje širší produktový záměr: oslovit tvůrce, kteří chtějí expresivní a dobře řízený přednes, i firmy vyvíjející hlasové agenty pro živé konverzace. Je to signál o směřování produktu, nikoli důkaz, že některý model už ovládl svůj trh.
ElevenLabs uvedlo, že jeho roční opakující se výnosy (ARR) překročily na začátku roku 2026 hranici 500 milionů dolarů. V únoru 2026 dosáhla společnost při investičním kole ocenění 11 miliard dolarů. 32
33 TechCrunch později informoval, že firma směřovala k ARR ve výši 600 milionů dolarů a její hodnota se údajně odhadovala na 22 miliard. Tuto uváděnou hodnotu není namístě zaměňovat za potvrzené nové investiční kolo. Stejný článek zmiňoval načasování vstupu na burzu jako ambici, nikoli jako oznámený úpis akcií.
28 TechCrunch označil za konkurenta také Decagon, dřívějšího zákazníka ElevenLabs; konkurence se tak rozšiřuje i do produktů určených přímo zákazníkům.
28
Pro týmy, které modely vybírají, je praktický postup jednoduchý: nejdřív si ujasněte, k čemu hlas potřebujete, a pak otestujte konkrétní hlas i celý pracovní postup. Porovnejte v4 a Turbo na stejném textu nebo úloze hlasového agenta, změřte odezvu od začátku do konce a ověřte, zda klonování a konzistence při delších textech splňují vaše požadavky. Uvedení přináší jasnou volbu mezi důrazem na kvalitu a rychlostí, ale samo o sobě neurčuje, který model bude nejlepší právě pro váš projekt.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Eleven v4, uvedený 28. září 2026, se zaměřuje na kvalitní a expresivní přednes; v4 Turbo cílí na živé hlasové agenty a podle ElevenLabs dosahuje mediánu latence inference přibližně 100 ms.
Eleven v4, uvedený 28. září 2026, se zaměřuje na kvalitní a expresivní přednes; v4 Turbo cílí na živé hlasové agenty a podle ElevenLabs dosahuje mediánu latence inference přibližně 100 ms. Oba modely podporují více než 90 jazyků. V4 přidává možnosti řízení projevu a znovu podporuje profesionální klonování hlasu; Turbo je varianta pro použití v reálném čase.
Uváděné první místo v žebříčku se týká modelu v4, nikoli automaticky Turba ani všech jazyků a způsobů použití.