По заявлению iFLYTEK, Spark ASR 2.0 реже ошибается при распознавании сложной речи и выдаёт более связный текст, но затраты на работу модели примерно на 10% выше, чем у версии 1.0. Подтверждённого числа диалектов именно для Spark ASR 2.0 нет: в публикациях и документации фигурируют разные показатели, которые нельзя с...
ОпубликовалОтредактировано с помощью GPT-6 SolИзображения созданы с помощью GPT Image 2
Ответ на исследование

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
iFLYTEK представила модель распознавания речи Spark-ASR-2.0 23 сентября 2026 года. Её задача — не только точнее переводить речь в текст, но и делать результат похожим на готовую запись, которую легче читать. Сообщения об улучшениях опираются преимущественно на заявления компании, а не на независимо воспроизводимое тестирование. 5
6
Меньше ошибок в сложных записях. iFLYTEK сообщает о снижении доли ошибочно распознанных слов по сравнению со Spark-ASR-1.0. Компания особо выделяет речь с переключением между китайским и английским, диалекты, специальную терминологию и записи с сильным шумом. Также заявлены улучшения для тихой или быстрой речи и детских голосов. Надёжной общей оценки прироста точности в процентных пунктах доступные материалы не дают. 5
6
Более гладкий текст — но не обязательно дословный. Spark-ASR-2.0 учитывает контекст, убирает речевые повторы и делает фразы связнее. Это удобно, если нужна читаемая расшифровка, но для протокола, цитаты или другого случая, где важна каждая произнесённая формулировка, результат стоит сверять с аудио. 5
7
Затраты на работу модели выше примерно на 10%. Именно так iFLYTEK сравнивает Spark-ASR-2.0 с версией 1.0. Речь о вычислительных затратах на обработку запросов, не об объявленном повышении цены API для клиентов на 10%. 5
6
В материалах о запуске названы три подхода: совместная работа двух способов распознавания, один из которых усилен большой языковой моделью (LLM); совместное улучшение обработки китайско-английского текста и аудио; динамическое добавление контекста. Компания связывает их с распознаванием смешанной речи, диалектов и терминов, а также с качеством текста в сложных акустических условиях. Однако опубликованные сведения не позволяют определить вклад каждого подхода в отдельности. Под «тихой речью» здесь понимается речь на малой громкости, а не распознавание аудио без звука. 5
6
19
Установленного числа для самой Spark-ASR-2.0 нет. В одном сообщении говорится о 38 вариантах диалектов и языков национальных меньшинств, в другом — о распознавании диалектов 202 городов. Отдельно документация iFLYTEK упоминает 202 диалекта для сервиса транскрибации в реальном времени, не подтверждая, что эта цифра относится к Spark-ASR-2.0. Складывать эти сведения в единую характеристику модели нельзя. 3
6
17
Утверждения о превосходстве над лучшими отраслевыми системами при распознавании диалектов, шумных записей и тихой речи тоже следует читать как сравнения, представленные компанией, а не как подтверждённый независимый рейтинг. 5
6
С 24 сентября 2026 года планировалось поэтапно внедрять Spark-ASR-2.0 в клавиатуру iFLYTEK Input Method. Сообщалось также о доступе через API и пробном запуске на открытой платформе iFLYTEK. В дальнейшем модель собираются использовать в ИИ-очках, офисных электронных блокнотах и продуктах для расшифровки iFLYTEK Tingjian; эти планы не означают, что все интеграции уже работают. 6
9
18
Среди следующих целей компании — не учитывать речь посторонних собеседников, позволить редактировать распознанный текст голосовыми командами и отображать результат с учётом эмоциональной окраски. Подтверждённых сроков выхода этих функций в доступных сообщениях нет. 18
Studio Global AI
На этой странице есть ответ, подтвержденный источником, который вы можете продолжить внутри Studio Global.
По заявлению iFLYTEK, Spark ASR 2.0 реже ошибается при распознавании сложной речи и выдаёт более связный текст, но затраты на работу модели примерно на 10% выше, чем у версии 1.0.
По заявлению iFLYTEK, Spark ASR 2.0 реже ошибается при распознавании сложной речи и выдаёт более связный текст, но затраты на работу модели примерно на 10% выше, чем у версии 1.0. Подтверждённого числа диалектов именно для Spark ASR 2.0 нет: в публикациях и документации фигурируют разные показатели, которые нельзя считать одной спецификацией.