Dilancarkan pada 28 September 2026, Eleven v4 mengutamakan penyampaian suara yang ekspresif, manakala v4 Turbo menyasarkan aplikasi langsung dengan latensi inferens median kira kira 100 ms. Kedua dua model menyokong lebih 90 bahasa.
Diterbitkan olehDisunting dengan GPT-6 LunaImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What are ElevenLabs’ new Eleven v4 and Eleven v4 Turbo text-to-speech models, how do their availability, architecture, voice cloning, langua. Article summary: ElevenLabs launched Eleven v4 and Eleven v4 Turbo on September 28, 2026: v4 prioritizes expressive, produced speech, while Turbo trades some emphasis on maximum quality for the speed needed by live voice agents. Together. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pelancaran ElevenLabs pada 28 September 2026 memperkenalkan dua pilihan untuk penjanaan pertuturan: Eleven v4 untuk audio yang lebih ekspresif dan siap diterbitkan, serta Eleven v4 Turbo untuk aplikasi masa nyata. Kedua-duanya menyokong lebih 90 bahasa dan pengklonan suara, tetapi tujuan penggunaannya berbeza. Dakwaan tentang mutu dan kelajuan ketika pelancaran juga bukan pengganti ujian menggunakan kandungan anda sendiri. 5
11
17
| Eleven v4 | Eleven v4 Turbo | |
|---|---|---|
| Direka untuk | Penciptaan kandungan, buku audio dan suara watak apabila mutu menjadi keutamaan |
Penggunaan masa nyata seperti ejen perbualan dan pengalaman suara interaktif |
| Tumpuan prestasi | Penyampaian ekspresif dan kawalan terhadap skrip |
Penjanaan pertuturan dengan latensi lebih rendah |
| Latensi yang dilaporkan | Tiada angka perbandingan setara dalam sumber yang tersedia | Kira-kira 100 ms latensi inferens median; kira-kira 150 ms hingga pertuturan pertama, menurut ElevenLabs |
| Sokongan bahasa | Lebih 90 bahasa |
Lebih 90 bahasa |
| Ketersediaan | ElevenAPI, ElevenAgents dan ElevenCreative |
ElevenAPI, ElevenAgents dan ElevenCreative |
Pilih v4 jika cara penyampaian, emosi dan kawalan skrip paling penting. Turbo lebih sesuai apabila aplikasi perlu memberikan respons dengan pantas. Dokumentasi yang tersedia menyatakan Turbo mengekalkan mutu yang tinggi sambil mengurangkan latensi, tetapi tidak menyertakan perbandingan mutu secara langsung bagi setiap jenis penggunaan. 17
ElevenLabs menyifatkan v4 sebagai model dengan seni bina baharu yang bertujuan memberikan lebih banyak kawalan terhadap nada, tempo, emosi dan watak. Bahan pelancaran awam menerangkan matlamat tersebut, tetapi tidak memperincikan seni binanya dengan cukup untuk penilaian teknikal bebas. 5
10
Model ini turut memperluas penggunaan tag audio sebaris, yang membolehkan pencipta mengarah cara sesuatu baris disampaikan. ElevenLabs memperkenalkan tag sebaris dalam v3; menurut TechCrunch, v4 membolehkan beberapa tag digabungkan dan diikuti mengikut urutannya. 5 Ini memberi lebih banyak arahan dalam skrip, namun hasilnya masih perlu disemak agar menepati persembahan yang dikehendaki.
Kedua-dua model baharu menyokong lebih 90 bahasa. ElevenLabs menyatakan bahawa Instant Voice Clone boleh dibuat daripada rakaman audio sesingkat 10 saat. Professional Voice Clone—yang menurut syarikat itu tidak disokong dalam v3—kembali dalam v4. 1
5
11
Bagi skrip panjang, ElevenLabs berkata ciri context stitching membantu mengekalkan tempo dan penyampaian yang stabil sepanjang skrip tanpa mengira panjangnya. Ini mungkin berguna untuk buku audio dan kandungan panjang yang lain, tetapi ia ialah dakwaan produk, bukannya bukti bebas bahawa setiap suara akan kekal konsisten dalam semua projek. 11
ElevenLabs melaporkan latensi inferens median v4 Turbo sekitar 100 ms dan masa median hingga pertuturan pertama sekitar 150 ms. Ini dua ukuran yang berbeza: satu merujuk kepada latensi inferens, manakala satu lagi ialah tempoh menunggu sebelum suara mula kedengaran. Kedua-duanya, secara berasingan, tidak menunjukkan seberapa pantas keseluruhan interaksi dengan ejen suara akan dirasai oleh pemanggil. 11
Interaksi langsung turut bergantung pada bahagian lain dalam sistem, termasuk pemprosesan audio pemanggil, penjanaan jawapan ejen dan penghantaran melalui rangkaian. Jadi, anggap angka latensi yang diterbitkan sebagai spesifikasi pada peringkat model; kemudian ukur masa respons dalam aplikasi yang benar-benar akan digunakan.
Satu laporan pelancaran menyatakan bahawa papan pendahulu Provider Voice Arena oleh Artificial Analysis meletakkan Eleven v4 di tempat pertama. Keputusan itu merujuk kepada v4 dalam satu penilaian tertentu; ia tidak membuktikan bahawa model ini mendahului dalam setiap bahasa, suara, tugasan panjang atau persediaan ejen langsung. 6 Kedudukan yang dirujuk itu juga tidak patut dianggap sebagai keputusan untuk Turbo: maklumat penanda aras yang tersedia tidak mengenal pasti penanda aras awam berasingan yang bersumber untuk v4 Turbo.
18
Cartesia dan Inworld turut disebut dalam liputan tentang alat suara masa nyata. Kehadiran penyedia lain menjadikan ujian secara langsung penting: bandingkan suara dan latensi menggunakan skrip, keadaan rangkaian dan aliran kerja ejen yang sama, bukannya bergantung pada angka latensi daripada penyedia semata-mata. 19
Pemisahan model ini mencerminkan strategi produk yang lebih luas: memenuhi keperluan pencipta yang mahukan narasi ekspresif dan terkawal, sambil menyasarkan syarikat yang membina ejen suara masa nyata. Ini menunjukkan arah kedudukan produk, bukan bukti bahawa mana-mana model sudah memenangi pasaran.
Syarikat itu melaporkan hasil berulang tahunan melebihi AS$500 juta pada awal 2026, dan pusingan pembiayaannya pada Februari 2026 menilai syarikat pada AS$11 bilion. 32
33 TechCrunch kemudian melaporkan bahawa syarikat itu berada pada landasan hasil berulang tahunan AS$600 juta dan dilaporkan bernilai AS$22 bilion; angka penilaian yang dilaporkan itu tidak patut disamakan dengan pusingan pembiayaan baharu yang telah disahkan. Laporan sama menyentuh masa IPO sebagai aspirasi, bukan penyenaraian yang sudah diumumkan.
28 TechCrunch turut menyifatkan Decagon, bekas pelanggan ElevenLabs, sebagai pesaing—contoh persaingan yang kini turut merangkumi produk suara untuk pelanggan.
28
Bagi pasukan yang sedang menilai model ini, langkah praktikalnya mudah: mulakan dengan kegunaan yang hendak dibina, kemudian uji suara dan aliran kerja tertentu. Bandingkan v4 dengan Turbo menggunakan skrip atau tugasan ejen yang sama, ukur latensi hujung ke hujung dan pastikan ciri pengklonan serta konsistensi kandungan panjang memenuhi keperluan anda. Pelancaran ini menjelaskan pilihan antara mutu dengan kelajuan, tetapi belum menentukan model mana yang akan memberikan hasil terbaik untuk projek anda.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Dilancarkan pada 28 September 2026, Eleven v4 mengutamakan penyampaian suara yang ekspresif, manakala v4 Turbo menyasarkan aplikasi langsung dengan latensi inferens median kira kira 100 ms.
Dilancarkan pada 28 September 2026, Eleven v4 mengutamakan penyampaian suara yang ekspresif, manakala v4 Turbo menyasarkan aplikasi langsung dengan latensi inferens median kira kira 100 ms. Kedua dua model menyokong lebih 90 bahasa. v4 menawarkan kawalan persembahan yang lebih terperinci dan sokongan Professional Voice Clone; Turbo pula direka untuk penggunaan masa nyata.
Kedudukan teratas yang dilaporkan dalam satu papan pendahulu merujuk kepada v4 sahaja, bukan secara automatik kepada Turbo atau semua bahasa dan kegunaan.