iFLYTEK lanserte Spark ASR 2.0 23. september 2026. Forbedringene skal særlig gjelde tale med både kinesisk og engelsk, dialekter, faguttrykk og krevende lyd.
Publisert avRedigert med GPT-6 SolBilder generert med GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
iFLYTEK lanserte talegjenkjenningsmodellen Spark-ASR-2.0 23. september 2026. Ambisjonen er ikke bare å gjengi tale mer presist enn Spark-ASR-1.0, men også å levere tekst som er lettere å lese. Ytelsestallene og sammenligningene i lanseringsomtalen bygger på selskapets egne opplysninger, ikke på en uavhengig test som kan etterprøves. 5
6
Færre feil: iFLYTEK melder om lavere ordfeilrate, særlig når folk veksler mellom kinesisk og engelsk, bruker dialekter eller snakker i støyende omgivelser. Selskapet trekker også frem faguttrykk, lav stemmestyrke, rask tale og barnestemmer. Det tilgjengelige materialet gir ikke grunnlag for å fastslå hvor stor den samlede forbedringen i treffsikkerhet er. 5
6
Mer bearbeidet tekst: Spark-ASR-2.0 skal bruke sammenhengen i det som sies til å rydde bort overflødige formuleringer og gjøre resultatet mer sammenhengende. Det kan være nyttig når målet er en lesbar tekst, men er noe annet enn en ordrett transkripsjon. Trenger du en nøyaktig gjengivelse av det som ble sagt, bør du kontrollere hvordan modellen behandler den muntlige ordlyden. 5
7
Høyere kjørekostnad: Ifølge iFLYTEK er den samlede kostnaden ved å kjøre modellen rundt 10 prosent høyere enn for Spark-ASR-1.0. Det er ikke det samme som en dokumentert prisøkning på 10 prosent for API-kunder. 5
6
Lanseringsomtalen peker på tre tekniske grep: samspill mellom ikke-autoregressiv talegjenkjenning og autoregressiv behandling styrket av store språkmodeller, felles forbedring av tekst- og lyddata for kinesisk–engelsk tale, og dynamisk tilførsel av kontekst. iFLYTEK knytter den samlede løsningen til bedre håndtering av språkveksling, dialekter, fagterminologi, krevende lyd og tekstutforming. Materialet viser ikke hvor mye hvert enkelt grep bidrar til hver forbedring. 5
6
19
De krevende lydtilfellene som omtales, omfatter mye støy og tale med lav stemmestyrke, i tillegg til rask tale og barnestemmer. Lav stemmestyrke betyr ikke at modellen kan transkribere lyd som er helt stille. 5
6
Det finnes ikke et godt dokumentert dialekttall for Spark-ASR-2.0. Én omtale oppgir 38 dialekt- og minoritetsspråkvarianter, mens en annen beskriver gjenkjenning av dialekter fra 202 byer. iFLYTEKs dokumentasjon nevner dessuten 202 dialekter for en tjeneste for sanntidstranskripsjon, uten å slå fast at tallet gjelder Spark-ASR-2.0. Tallene bør derfor ikke leses som en bekreftet spesifikasjon for modellen. 3
6
17
Påstander om at modellen slår bransjens beste systemer på dialekter, støy eller tale med lav stemmestyrke, er også selskapets sammenligninger – ikke uavhengig fastslåtte rangeringer. 5
6
En gradvis utrulling i iFLYTEKs inntastingsapp var planlagt fra 24. september 2026. Omtalen beskriver også API-tilgang og en mulighet til å prøve modellen via iFLYTEKs åpne utviklerplattform. AI-briller, smarte kontornotatbøker og selskapets Tingjian-produkter for transkripsjon er nevnt som senere bruksområder; det betyr ikke at alle integrasjonene allerede er tilgjengelige. 6
9
18
Videre vil iFLYTEK arbeide med å avvise tale fra uvedkommende personer, la brukere redigere gjenkjent tekst med talekommandoer og presentere resultater med hensyn til følelsesuttrykk. Det er ikke oppgitt noen bekreftet lanseringsdato for disse funksjonene. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
iFLYTEK lanserte Spark ASR 2.0 23. september 2026.
iFLYTEK lanserte Spark ASR 2.0 23. september 2026. Forbedringene skal særlig gjelde tale med både kinesisk og engelsk, dialekter, faguttrykk og krevende lyd.