iFLYTEK представила Spark ASR 2.0 23 вересня 2026 року. За даними компанії, модель робить менше помилок і формує зв’язніший текст, а витрати на обробку зростають приблизно на 10%.
ОпублікувавВідредаговано за допомогою GPT-6 SolЗображення створено за допомогою GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
iFLYTEK випустила модель розпізнавання мовлення Spark-ASR-2.0 23 вересня 2026 року. Її завдання — не лише точніше перетворювати голос на текст, а й робити результат схожим на готовий до читання запис. Водночас наведені порівняння з Spark-ASR-1.0 спираються на дані компанії, а не на незалежно відтворюване тестування. 5
6
За словами iFLYTEK, у версії 2.0 знизилася частота помилок розпізнавання слів. Найпомітніші покращення компанія відзначає для мовлення, у якому чергуються китайська й англійська, китайських діалектів та записів із сильним шумом. Також заявлено кращу роботу з фаховою термінологією, тихим або швидким мовленням і дитячими голосами. Надійної оцінки загального приросту точності у відсоткових пунктах доступні матеріали не дають. 5
6
Інша відмінність — читабельність транскрипту. Модель має враховувати контекст, прибирати зайві повтори й формувати зв’язніші речення. Це зручно, якщо потрібен текст для подальшої роботи, але не те саме, що дослівний запис: для протоколу чи іншого випадку, де важливе кожне сказане слово, результат варто звіряти з аудіо. 5
7
iFLYTEK оцінює витрати на обробку запитів новою моделлю приблизно на 10% вище, ніж у Spark-ASR-1.0. Йдеться про витрати на роботу моделі, а не про оголошене підвищення ціни API для клієнтів на 10%. 5
6
У повідомленнях про запуск названо три підходи: спільну роботу неавторегресійного розпізнавання й авторегресійної обробки, підсиленої великою мовною моделлю; спільне вдосконалення обробки китайсько-англійських текстів та аудіо; динамічне додавання контексту. iFLYTEK пов’язує їхню сукупність із кращим розпізнаванням змішаного мовлення, діалектів і термінів, а також зі стійкістю до складних акустичних умов. Даних, які показували б внесок кожного підходу окремо, у цих повідомленнях немає. 5
6
19
Серед складних випадків ідеться про гучний фоновий шум і тихе мовлення, а також швидку вимову та дитячі голоси. Тихе мовлення не означає відсутність звуку: заяв про розпізнавання беззвучного запису немає. 5
6
Єдиного підтвердженого числа для Spark-ASR-2.0 немає. Одне повідомлення згадує 38 діалектних і міноритарних мовних різновидів, інше — розпізнавання діалектів із 202 міст. Окремо документація iFLYTEK вказує 202 діалекти для сервісу транскрибування в реальному часі, але не встановлює, що ця характеристика стосується саме Spark-ASR-2.0. Зводити ці три формулювання до однієї специфікації моделі не варто. 3
6
17
Так само твердження про перевагу над найкращими галузевими системами в розпізнаванні діалектів, шумного й тихого мовлення залишаються порівняннями компанії, а не незалежно встановленим рейтингом. 5
6
Поступове впровадження в iFLYTEK Input Method, застосунку для введення тексту, планували розпочати 24 вересня 2026 року. Також повідомлялося про доступ через API та можливість спробувати модель на відкритій платформі iFLYTEK. Надалі її планують інтегрувати в розумні окуляри компанії, офісні цифрові блокноти й продукти для транскрибування iFLYTEK Tingjian. Ці плани не означають, що всі інтеграції вже працюють. 6
9
18
Серед наступних цілей iFLYTEK називає відсікання голосів сторонніх мовців, редагування розпізнаного тексту голосовими командами та відображення результату з урахуванням емоцій. Підтвердженої дати запуску цих можливостей у доступних повідомленнях немає. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
iFLYTEK представила Spark ASR 2.0 23 вересня 2026 року. За даними компанії, модель робить менше помилок і формує зв’язніший текст, а витрати на обробку зростають приблизно на 10%.
iFLYTEK представила Spark ASR 2.0 23 вересня 2026 року. За даними компанії, модель робить менше помилок і формує зв’язніший текст, а витрати на обробку зростають приблизно на 10%. Покращення заявлені для змішаного китайсько англійського мовлення, діалектів, фахових термінів і складного аудіо.