iFLYTEK melancarkan Spark ASR 2.0 pada 23 September 2026. Syarikat mendakwa ralat pengecaman berkurang dan transkrip lebih mudah dibaca, dengan kos inferens kira kira 10% lebih tinggi berbanding 1.0.
Diterbitkan olehDisunting dengan GPT-6 SolImej dijana dengan GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
iFLYTEK melancarkan Spark-ASR-2.0 pada 23 September 2026 dengan sasaran yang melangkaui menukar suara kepada teks: hasil transkrip juga diharapkan lebih tersusun dan lancar dibaca. Namun, penambahbaikan prestasi yang dilaporkan setakat pelancaran datang daripada syarikat; bukti yang tersedia belum membolehkan perbandingan itu disahkan secara bebas. 5
6
Ketepatan pengecaman. iFLYTEK melaporkan kadar ralat perkataan yang lebih rendah, khususnya bagi pertuturan bercampur bahasa Cina–Inggeris, dialek dan rakaman yang bising. Syarikat turut menyebut peningkatan untuk istilah bidang khusus, suara perlahan, pertuturan pantas dan suara kanak-kanak. Tiada angka kukuh dalam laporan pelancaran yang menetapkan peningkatan ketepatan keseluruhan dalam mata peratusan. 5
6
Kelancaran teks. Model baharu ini direka untuk menggunakan konteks bagi membuang ungkapan berulang dan menghasilkan ayat yang lebih jelas. Itu berguna jika mahukan teks yang terus sedap dibaca, tetapi tidak semestinya sama dengan transkrip kata demi kata. Untuk rekod yang perlu mengekalkan pertuturan asal, semak sama ada perkataan penutur telah diubah atau diringkaskan. 5
7
Kos menjalankan model. Menurut iFLYTEK, kos inferens keseluruhan meningkat kira-kira 10% berbanding Spark-ASR-1.0. Ini merujuk kepada kos menjalankan model, bukan pengumuman bahawa harga API untuk pelanggan naik 10%. 5
6
Laporan pelancaran menyebut tiga pendekatan: kerjasama antara pengecaman bukan autoregresif dengan pemprosesan autoregresif yang dipertingkat model bahasa besar (LLM); penambahbaikan bersama data teks dan audio Cina–Inggeris; serta kemasukan konteks secara dinamik. iFLYTEK mengaitkan gabungan ini dengan pengecaman yang lebih baik apabila penutur bertukar bahasa, menggunakan dialek atau istilah teknikal, serta bercakap dalam keadaan akustik yang mencabar. Namun, laporan tersebut tidak mengasingkan sumbangan setiap teknik kepada setiap peningkatan. 5
6
19
Keadaan mencabar yang disebut termasuk bunyi bising yang kuat dan suara pada kelantangan rendah, selain pertuturan pantas dan suara kanak-kanak. “Kelantangan rendah” bukan bermaksud model itu boleh mentranskripsikan audio yang senyap sepenuhnya. 5
6
Belum ada angka khusus Spark-ASR-2.0 yang dapat dipastikan. Satu laporan menyebut 38 variasi dialek dan bahasa minoriti, manakala laporan lain merujuk kepada pengecaman dialek dari 202 bandar. Secara berasingan, dokumentasi iFLYTEK mengiklankan sokongan 202 dialek untuk perkhidmatan transkripsi masa nyata, tanpa memastikan angka itu terpakai kepada Spark-ASR-2.0. Ketiga-tiga keterangan ini tidak wajar digabungkan menjadi satu spesifikasi model yang telah disahkan. 3
6
17
Begitu juga, dakwaan bahawa model ini mengatasi sistem terbaik industri bagi dialek, bunyi bising atau suara perlahan ialah perbandingan yang dilaporkan oleh syarikat, bukannya kedudukan yang telah disahkan secara bebas. 5
6
Pelancaran secara berperingkat dalam iFLYTEK Input Method dijadualkan bermula 24 September 2026. Laporan turut menyebut akses API dan ruang percubaan melalui iFLYTEK Open Platform, diikuti rancangan penggunaan pada cermin mata AI, buku nota pejabat pintar dan produk transkripsi iFLYTEK Tingjian. Rancangan itu tidak bermakna setiap integrasi sudah tersedia. 6
9
18
Bagi pembangunan seterusnya, iFLYTEK menyasarkan keupayaan mengabaikan suara penutur yang tidak berkaitan, menyunting teks yang dikenal pasti melalui arahan suara, dan memaparkan hasil dengan mengambil kira emosi. Tiada tarikh keluaran yang disahkan untuk ciri-ciri tersebut dalam laporan yang dirujuk. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
iFLYTEK melancarkan Spark ASR 2.0 pada 23 September 2026. Syarikat mendakwa ralat pengecaman berkurang dan transkrip lebih mudah dibaca, dengan kos inferens kira kira 10% lebih tinggi berbanding 1.0.
iFLYTEK melancarkan Spark ASR 2.0 pada 23 September 2026. Syarikat mendakwa ralat pengecaman berkurang dan transkrip lebih mudah dibaca, dengan kos inferens kira kira 10% lebih tinggi berbanding 1.0. Penambahbaikan yang dilaporkan meliputi pertuturan bercampur bahasa Cina–Inggeris, dialek, istilah khusus, bunyi bising serta suara perlahan atau pantas.