تقول iFLYTEK إن نموذجها، الذي أطلقته في 23 سبتمبر 2026، يقلّل أخطاء التفريغ ويُنتج نصًا أسلس من الإصدار الأول، مقابل ارتفاع تكلفة تشغيله بنحو 10%. تشمل التحسينات المعلنة اللهجات والمصطلحات المتخصصة والضوضاء والكلام الخافت أو السريع وأصوات الأطفال والحديث المختلط بين الصينية والإنجليزية؛ ولم يثبت رقم محدد للهجات التي...
نشر بواسطةتم التحرير باستخدام GPT-6 Solتم إنشاء الصور باستخدام GPT Image 2
إجابة البحث

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
أطلقت شركة iFLYTEK نموذج Spark-ASR-2.0 للتعرّف على الكلام في 23 سبتمبر 2026. والفكرة ليست تحويل الصوت إلى كلمات بدقة أعلى فحسب، بل إخراج نص يبدو أقرب إلى صياغة جاهزة للقراءة. غير أن مقارنات الأداء المتاحة عند الإطلاق تستند إلى تصريحات الشركة، لا إلى تقييم مستقل يمكن إعادة إجرائه. 5
6
تذكر تقارير الإطلاق ثلاثة أساليب: الجمع بين معالجة غير توليدية تدريجية ومعالجة توليدية تدريجية معززة بنموذج لغوي كبير، وتحسين بيانات النص والصوت الصينية والإنجليزية معًا، وإدخال معلومات السياق بصورة ديناميكية. وتربط iFLYTEK هذه الأساليب بتحسّن فهم الكلام المختلط واللهجات والمصطلحات وظروف التسجيل الصعبة، من دون أن توضّح مساهمة كل أسلوب على حدة في النتائج. 5
6
19
لا يوجد رقم محسوم خاص بـSpark-ASR-2.0 في الأدلة المتاحة. يذكر تقرير 38 تنويعة من اللهجات ولغات الأقليات، بينما يتحدث آخر عن التعرّف على لهجات من 202 مدينة. وتورد وثائق iFLYTEK رقم 202 لهجة لخدمة تفريغ فوري، من دون إثبات أن الرقم ينطبق على هذا النموذج تحديدًا. لذلك لا يصح التعامل مع هذه الأرقام على أنها مواصفة واحدة مؤكدة. وكذلك تبقى مزاعم تفوق النموذج على أفضل الأنظمة الأخرى في اللهجات والضوضاء والكلام الخافت مقارنات منسوبة إلى الشركة، وليست ترتيبًا مثبتًا بصورة مستقلة. 3
5
6
17
كان مقررًا بدء طرح النموذج تدريجيًا في تطبيق iFLYTEK Input Method للكتابة بالصوت اعتبارًا من 24 سبتمبر 2026. وتشير التقارير إلى إتاحة واجهة برمجة تطبيقات ونقطة لتجربته عبر منصة iFLYTEK المفتوحة، مع خطط لإدماجه لاحقًا في نظارات الذكاء الاصطناعي ودفاتر العمل الذكية ومنتجات التفريغ iFLYTEK Tingjian. ولا تعني هذه الخطط أن جميع عمليات الدمج أصبحت متاحة بالفعل. 6
9
18
أما الأهداف التالية التي حددتها الشركة فتشمل تجاهل أصوات المتحدثين غير المعنيين، وتعديل النص بأوامر صوتية، وعرض النتائج بطريقة تراعي التعبير العاطفي. ولم تذكر التقارير موعد إصدار مؤكدًا لهذه الإمكانات. 18
Studio Global AI
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
تقول iFLYTEK إن نموذجها، الذي أطلقته في 23 سبتمبر 2026، يقلّل أخطاء التفريغ ويُنتج نصًا أسلس من الإصدار الأول، مقابل ارتفاع تكلفة تشغيله بنحو 10%.
تقول iFLYTEK إن نموذجها، الذي أطلقته في 23 سبتمبر 2026، يقلّل أخطاء التفريغ ويُنتج نصًا أسلس من الإصدار الأول، مقابل ارتفاع تكلفة تشغيله بنحو 10%. تشمل التحسينات المعلنة اللهجات والمصطلحات المتخصصة والضوضاء والكلام الخافت أو السريع وأصوات الأطفال والحديث المختلط بين الصينية والإنجليزية؛ ولم يثبت رقم محدد للهجات التي يدعمها النموذج.