iFLYTEK השיקה את Spark ASR 2.0 ב־23 בספטמבר 2026. לטענתה, הדגם מפחית שגיאות זיהוי ומפיק טקסט קריא יותר, בעוד עלות ההרצה שלו גבוהה בכ־10% מזו של גרסה 1.0.
פורסם על ידינערך באמצעות GPT-6 Solהתמונות נוצרו באמצעות GPT Image 2
Research answer

Create a landscape editorial hero image for this Studio Global article: What is iFLYTEK Spark-ASR-2.0, released on September 23, 2026, and how does it compare with Spark-ASR-1.0 in recognition accuracy, text flue. Article summary: iFLYTEK released Spark-ASR-2.0 on September 23, 2026, as an upgrade to its speech-to-text model. It aims to produce not just a more accurate transcript than Spark-ASR-1.0, but more fluent, readable text; the reported gai. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
iFLYTEK השיקה ב־23 בספטמבר 2026 את Spark-ASR-2.0, דגם לזיהוי דיבור והמרתו לטקסט. ההבטחה אינה רק לזהות יותר מילים נכון, אלא גם להפיק תמלול שנקרא כמו טקסט ערוך. נתוני השיפור וההשוואות לגרסה הקודמת מבוססים על דיווחי החברה בעת ההשקה, ולא על הערכה עצמאית שניתן לשחזר מתוכה את התוצאות. 5
6
דיוק הזיהוי: iFLYTEK מדווחת על ירידה בשיעור שגיאות המילים, במיוחד בדיבור שמשלב סינית ואנגלית, בניבים ובהקלטות רועשות. היא מתארת שיפור גם בזיהוי מונחים מקצועיים, דיבור חלש או מהיר וקולות של ילדים. הדיווחים הזמינים אינם מאפשרים לקבוע בכמה נקודות אחוז השתפר הדיוק הכולל. 5
6
קריאות התמלול: הדגם החדש נועד להיעזר בהקשר כדי לצמצם חזרות וניסוחים מיותרים ולהפיק טקסט רציף וברור יותר. זה עשוי לחסוך עריכה למי שרוצה להפוך דיבור לטיוטה כתובה, אך אינו זהה לתמלול מילה במילה. אם חשוב לשמר את הניסוח המדויק שנאמר, כדאי לבדוק כיצד הפלט מטפל בו. 5
7
עלות ההרצה: לפי iFLYTEK, עלות ההסקה — כלומר עלות הפעלת הדגם לעיבוד הבקשות — גבוהה בכ־10% מזו של Spark-ASR-1.0. אין פירוש הדבר שפורסמה התייקרות של 10% במחיר ה־API ללקוחות. 5
6
בדיווחי ההשקה מוזכר שילוב בין זיהוי לא־אוטורגרסיבי לעיבוד אוטורגרסיבי בסיוע מודל שפה גדול, חיזוק משותף של נתוני טקסט ושמע בסינית ובאנגלית, והזרקה דינמית של הקשר. iFLYTEK קושרת את השילוב הזה לשיפור במעבר בין סינית לאנגלית באמצע משפט, בניבים, במונחים מקצועיים, בתנאי שמע קשים ובעיצוב התמלול. לא פורסם פירוט שמבודד את תרומתה של כל שיטה לכל אחד מהשיפורים. 5
6
19
תנאי השמע הקשים שנזכרו כוללים רעש חזק ודיבור בעוצמה נמוכה, לצד דיבור מהיר וקולות של ילדים. דיבור חלש אינו דיבור שקט לחלוטין: אין כאן טענה שהדגם מסוגל לתמלל הקלטה ללא קול. 5
6
אין בראיות הזמינות מספר מבוסס אחד של ניבים הנתמכים ב־Spark-ASR-2.0 עצמו. דיווח אחד מציין 38 גרסאות של ניבים ושפות מיעוטים, ואחר מתאר זיהוי ניבים מ־202 ערים. בנפרד, תיעוד של iFLYTEK מציין 202 ניבים עבור שירות תמלול בזמן אמת, בלי לקבוע שהנתון חל על הדגם החדש. אלה תיאורים שונים, ואין לאחד אותם למפרט מאומת. 3
6
17
גם הטענות שלפיהן הדגם עולה על המערכות המובילות בענף בזיהוי ניבים, רעש או דיבור חלש נשענות על השוואות שמדווחת החברה; הן אינן דירוג עצמאי מבוסס. 5
6
השקה הדרגתית של הדגם ביישום ההקלדה iFLYTEK Input Method תוכננה להתחיל ב־24 בספטמבר 2026. הדיווחים מתארים גם גישה למפתחים דרך API ואפשרות להתנסות באמצעות הפלטפורמה הפתוחה של iFLYTEK. בהמשך מתוכננים שילובים במשקפי AI, במחברות משרדיות חכמות ובמוצרי התמלול iFLYTEK Tingjian — אך התוכניות אינן מעידות שכל השילובים כבר זמינים. 6
9
18
לשלבי הפיתוח הבאים החברה מציינת שלושה יעדים: התעלמות מדיבור של אנשים שאינם הדובר הרלוונטי, עריכת הטקסט שזוהה באמצעות פקודות קוליות והצגת תוצאות שמתחשבת ברגש. בדיווחים המצוטטים אין מועד השקה מאומת ליכולות הללו. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
iFLYTEK השיקה את Spark ASR 2.0 ב־23 בספטמבר 2026. לטענתה, הדגם מפחית שגיאות זיהוי ומפיק טקסט קריא יותר, בעוד עלות ההרצה שלו גבוהה בכ־10% מזו של גרסה 1.0.
iFLYTEK השיקה את Spark ASR 2.0 ב־23 בספטמבר 2026. לטענתה, הדגם מפחית שגיאות זיהוי ומפיק טקסט קריא יותר, בעוד עלות ההרצה שלו גבוהה בכ־10% מזו של גרסה 1.0. השיפורים המדווחים נוגעים בין היתר לדיבור המשלב סינית ואנגלית, לניבים, למונחים מקצועיים ולדיבור בתנאים קשים.