23 सितंबर 2026 को जारी Spark ASR 2.0 के बारे में iFLYTEK का कहना है कि यह 1.0 से कम ट्रांसक्रिप्शन त्रुटियाँ करता है और अधिक पढ़ने योग्य पाठ देता है; मॉडल चलाने की लागत लगभग 10% अधिक बताई गई है। [5][6] चीनी–अंग्रेज़ी मिली जुली बातचीत, बोलियों, तकनीकी शब्दों और कठिन ऑडियो में सुधार का दावा है, लेकिन इस मॉडल द्वारा सम...
प्रकाशितकर्ताGPT-6 Sol से संपादितGPT Image 2 से चित्र बनाए गए
शोध उत्तर

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
iFLYTEK ने 23 सितंबर 2026 को Spark-ASR-2.0 जारी किया। इसका लक्ष्य सिर्फ़ बोली गई बात को लिखना नहीं, बल्कि ऐसा ट्रांसक्रिप्ट देना भी है जिसे पढ़ना आसान हो। Spark-ASR-1.0 के मुकाबले सुधार के आँकड़े और दूसरे सिस्टमों से तुलना कंपनी से आए दावों पर आधारित हैं; उपलब्ध रिपोर्टिंग स्वतंत्र रूप से दोहराई जा सकने वाली जाँच पेश नहीं करती। 5
6
पहचान की सटीकता: iFLYTEK के मुताबिक नए मॉडल में शब्द त्रुटि दर—यानी बोले गए शब्दों को लिखने में होने वाली गलतियों का माप—घटी है। कंपनी खास तौर पर चीनी और अंग्रेज़ी मिलाकर बोलने, चीनी बोलियों, तकनीकी शब्दों तथा शोर वाले ऑडियो में सुधार बताती है। धीमी आवाज़, तेज़ बोलचाल और बच्चों की आवाज़ के लिए भी बेहतर नतीजों का दावा है। लेकिन कुल सटीकता कितने प्रतिशत अंक बढ़ी, इसका भरोसेमंद आँकड़ा उपलब्ध रिपोर्टिंग से तय नहीं होता। 5
6
पाठ की पठनीयता: मॉडल संदर्भ देखकर दोहराव घटाने और वाक्यों को अधिक सुसंगत बनाने के लिए तैयार किया गया है। यह हूबहू ट्रांसक्रिप्ट से अलग लक्ष्य है। यदि हर बोला हुआ शब्द दर्ज रहना ज़रूरी हो, तो आउटपुट की मूल ऑडियो से जाँच करनी चाहिए। 5
7
चलाने की लागत: कंपनी के अनुसार Spark-ASR-2.0 की कुल इन्फ़रेंस लागत लगभग 10% अधिक है। इन्फ़रेंस लागत का मतलब मॉडल को चलाने की लागत है; इसे ग्राहकों के लिए API की कीमत में घोषित 10% बढ़ोतरी नहीं समझना चाहिए। 5
6
लॉन्च रिपोर्टों में तीन तरीके बताए गए हैं: गैर-ऑटोरिग्रेसिव पहचान और बड़े भाषा मॉडल से संवर्धित ऑटोरिग्रेसिव प्रोसेसिंग को साथ इस्तेमाल करना; चीनी–अंग्रेज़ी मिश्रित पाठ और ऑडियो पर संयुक्त संवर्धन; और ज़रूरत के मुताबिक संदर्भ जोड़ना। iFLYTEK इन्हें भाषा बदल-बदलकर बोलने, बोलियों, विशेषज्ञ शब्दावली, मुश्किल ऑडियो और ट्रांसक्रिप्ट की प्रस्तुति में सुधार से जोड़ती है। किस तकनीक का किस सुधार में कितना योगदान है, यह अलग से स्थापित नहीं किया गया है। 5
6
19
यहाँ धीमी आवाज़ का मतलब कम वॉल्यूम पर बोली गई बात है, ख़ामोश ऑडियो से शब्द निकालने का दावा नहीं। रिपोर्टों में अधिक शोर, तेज़ बोलचाल और बच्चों की आवाज़ का भी उल्लेख है। 5
6
Spark-ASR-2.0 के लिए बोलियों की कोई पुष्ट संख्या स्पष्ट नहीं है। एक रिपोर्ट 38 बोलियों और अल्पसंख्यक भाषाओं के रूपों की बात करती है; दूसरी 202 शहरों की बोलियों की पहचान बताती है। iFLYTEK के दस्तावेज़ में अलग रियल-टाइम ट्रांसक्रिप्शन सेवा के लिए 202 बोलियों का उल्लेख है, लेकिन उससे यह साबित नहीं होता कि वही संख्या Spark-ASR-2.0 पर लागू होती है। इन तीन विवरणों को जोड़कर मॉडल की एक पक्की विशिष्टता नहीं मानना चाहिए। 3
6
17
इसी तरह, बोलियों, शोर या धीमी आवाज़ में उद्योग के सर्वश्रेष्ठ सिस्टमों से आगे होने की तुलना भी कंपनी का दावा है, स्वतंत्र रूप से स्थापित रैंकिंग नहीं। 5
6
24 सितंबर 2026 से iFLYTEK Input Method में मॉडल को चरणबद्ध तरीके से उपलब्ध कराने की योजना थी। रिपोर्टों के मुताबिक डेवलपरों के लिए iFLYTEK Open Platform के ज़रिए API और इसे आज़माने का विकल्प भी बताया गया है। आगे AI चश्मों, स्मार्ट ऑफिस नोटबुक और iFLYTEK Tingjian ट्रांसक्रिप्शन उत्पादों में इसे जोड़ने की योजना है; इससे यह नहीं मान लेना चाहिए कि हर उत्पाद में यह सुविधा पहले से चालू है। 6
9
18
आगे के लिए कंपनी ने तीन लक्ष्य बताए हैं: असंबंधित व्यक्ति की आवाज़ को नज़रअंदाज़ करना, आवाज़ के निर्देश से पहचाने गए पाठ को संपादित करना और भावनाओं को ध्यान में रखकर परिणाम प्रस्तुत करना। इन सुविधाओं की पुष्ट रिलीज़ तारीख रिपोर्टों में नहीं दी गई है। 18
Studio Global AI
इस पृष्ठ में एक स्रोत-समर्थित उत्तर शामिल है जिसे आप Studio Global के अंदर जारी रख सकते हैं।
23 सितंबर 2026 को जारी Spark ASR 2.0 के बारे में iFLYTEK का कहना है कि यह 1.0 से कम ट्रांसक्रिप्शन त्रुटियाँ करता है और अधिक पढ़ने योग्य पाठ देता है; मॉडल चलाने की लागत लगभग 10% अधिक बताई गई है। [5][6]
23 सितंबर 2026 को जारी Spark ASR 2.0 के बारे में iFLYTEK का कहना है कि यह 1.0 से कम ट्रांसक्रिप्शन त्रुटियाँ करता है और अधिक पढ़ने योग्य पाठ देता है; मॉडल चलाने की लागत लगभग 10% अधिक बताई गई है। [5][6] चीनी–अंग्रेज़ी मिली जुली बातचीत, बोलियों, तकनीकी शब्दों और कठिन ऑडियो में सुधार का दावा है, लेकिन इस मॉडल द्वारा समर्थित बोलियों की पुष्ट संख्या उपलब्ध नहीं है। [3][5][6][17]