Flash أم Flash-Lite؟ دليل إلى نموذجي جوجل الجديدين لتوليد الصوت
أعلنت جوجل النموذجين في 23 سبتمبر 2026: Flash TTS للتحكم الإبداعي الدقيق، وFlash Lite TTS للمهام الصوتية واسعة النطاق بتكلفة أقل. تقول جوجل إنها توفر أكثر من 2000 صوت جاهز وإمكانية توجيه الأداء سطرًا بسطر؛ أما استنساخ صوت شخص موجود فيتطلب التحقق من موافقته.
نشر بواسطةتم التحرير باستخدام GPT-6 Solتم إنشاء الصور باستخدام GPT Image 2
أعلنت جوجل النموذجين في 23 سبتمبر 2026: Flash TTS للتحكم الإبداعي الدقيق، وFlash Lite TTS للمهام الصوتية واسعة النطاق بتكلفة أقل.
تقول جوجل إنها توفر أكثر من 2000 صوت جاهز وإمكانية توجيه الأداء سطرًا بسطر؛ أما استنساخ صوت شخص موجود فيتطلب التحقق من موافقته.
What are Google’s Gemini 3.8 Flash TTS and Flash-Lite TTS models, how do they differ in intended use, and what did Google announce about theAI-generated editorial illustration; not an image of the models’ interface.
موجّه الذكاء الاصطناعي
Create a landscape editorial hero image for this Studio Global article: What are Google’s Gemini 3.8 Flash TTS and Flash-Lite TTS models, how do they differ in intended use, and what did Google announce about the. Article summary: Google announced Gemini 3.8 Flash TTS and Gemini 3.8 Flash-Lite TTS on September 23, 2026, as text-to-speech models for generating expressive spoken audio. Flash TTS is aimed at detailed creative direction and character . Topic tags: general, documentation, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
openai.com
إذا كنت تنتج مشهدًا يحتاج إلى صوت شخصية مميز، أو تدبلج عددًا كبيرًا من المقاطع، فقدّمت جوجل في 23 سبتمبر 2026 خيارين مختلفين لتحويل النص إلى كلام: Gemini 3.8 Flash TTS للتصميم الصوتي والتوجيه الإبداعي، وGemini 3.8 Flash-Lite TTS للإنتاج واسع النطاق بتكلفة أقل. ويستهدف الثاني، ضمن استخداماته، الدبلجة والمحتوى الصوتي والمساعدين الصوتيين؛ لكنه لا يقتصر على قراءة النص بنبرة واحدة. 427
أي النموذجين أنسب للعمل؟
يتيح Flash TTS إنشاء صوت شخصية من وصف بلغتك المعتادة لدورها ولهجتها وخصائصها الصوتية، ثم توجيه طريقة أدائها في المشاهد المكتوبة. لذا فهو الخيار الذي تركز عليه جوجل حين تكون هوية الصوت وطريقة إلقاء الجمل جزءًا أساسيًا من العمل. 430
أما Flash-Lite TTS فتقدمه جوجل للمهام التي تتطلب إنتاج مقاطع صوتية كثيرة بكفاءة في التكلفة، مع الإبقاء على أدوات لضبط النبرة والسرعة والتعبير؛ فالفرق بين النموذجين هو أولوية الاستخدام، لا غياب التحكم في أداء النسخة الأخف. 2730
أصوات جاهزة، وأخرى تُنشأ أو تُستنسخ
أعلنت جوجل إتاحة أكثر من 2000 صوت جاهز، إلى جانب إنشاء أصوات جديدة باستخدام الأوامر النصية. ويمكن توجيه حوار متبادل وتحديد أداء كل جملة، بما في ذلك النبرة واللهجة وإيقاع الكلام. 42829
وتصف جوجل إنشاء الأصوات بأنه يدعم أكثر من 100 لغة ولهجة. وتورد قوائم خارجية رقمين أكثر تحديدًا: 130 لغة لـFlash TTS و101 لغة لـFlash-Lite TTS. هذه أرقام تغطية منشورة، وليست ضمانًا بأن كل صوت أو ميزة يعمل بكل لغة. 271718
وهناك فرق مهم بين ابتكار صوت جديد واستنساخ صوت شخص موجود: الثاني يعتمد على عينة من صوته. ووصفت تغطية الإطلاق عينة مرجعية مدتها نحو 30 ثانية، مع التحقق من موافقة صاحب الصوت قبل الاستنساخ. 2223
ما الضمانات؟ وماذا تقول الاختبارات؟
تقول جوجل إن استنساخ الصوت يتضمن التحقق من الموافقة. وتذكر تقارير الإطلاق أيضًا تضمين علامة SynthID في الصوت المولّد، وإرفاق بيانات منشأ وفق معيار C2PA بالأصوات المستنسخة. هذه تدابير حماية، لا دليل على استحالة إساءة الاستخدام. 2334
وفي نتائج أُعلنت عند الإطلاق، حقق Flash TTS المركز الأول بنتيجة 71.4 في اختبار تصميم الأصوات لدى Hume AI؛ وأورد تقرير آخر نتيجة 60.8 في مقياس لمحاكاة اللهجات. وقالت جوجل إن النموذجين احتلا المركزين الأول والثاني في مؤشر الجودة الإجمالية لدى Hume AI. إنها نتائج اختبارات مُعلنة، وليست حكمًا مستقلًا على أدائهما في كل تطبيق. 1921
أين يمكن استخدامهما؟
قالت جوجل إن طرح النموذجين للمطورين بدأ عبر Google AI Studio وواجهة Gemini API في 23 سبتمبر، وتُدرج ملاحظات إصدار الواجهة النموذجين وواجهة Voices ضمن المتاحين رسميًا. أما في منتجات المستخدمين، فحددت Flash TTS لمنتج Gemini Notebook وFlash-Lite TTS لمنتج Google Vids، وقالت إن إتاحتهما عبر Gemini Enterprise ستأتي لاحقًا. ولا يعني وصول نموذج إلى منتج ما أن جميع ميزات الأصوات كانت متاحة فيه عند الإطلاق. 2932
وأشارت تقارير أولية إلى دمج التقنية في منصات منها Agora وLiveKit وPipecat وVercel، وإلى اهتمام شركات مثل Figma وHeyGen وWondercraft باستخدامها في الدبلجة والتوطين والمساعدين الصوتيين. لكن ذلك لا يعني توافر الميزات نفسها في جميع عمليات الدمج. 37
Studio Global AI
مواصلة البحث الخاص بك
تتضمن هذه الصفحة إجابة مدعومة بالمصدر يمكنك المتابعة داخل Studio Global.
ما هي الإجابة المختصرة على "Flash أم Flash-Lite؟ دليل إلى نموذجي جوجل الجديدين لتوليد الصوت"؟
أعلنت جوجل النموذجين في 23 سبتمبر 2026: Flash TTS للتحكم الإبداعي الدقيق، وFlash Lite TTS للمهام الصوتية واسعة النطاق بتكلفة أقل.
ما هي النقاط الأساسية التي يجب التحقق منها أولاً؟
أعلنت جوجل النموذجين في 23 سبتمبر 2026: Flash TTS للتحكم الإبداعي الدقيق، وFlash Lite TTS للمهام الصوتية واسعة النطاق بتكلفة أقل. تقول جوجل إنها توفر أكثر من 2000 صوت جاهز وإمكانية توجيه الأداء سطرًا بسطر؛ أما استنساخ صوت شخص موجود فيتطلب التحقق من موافقته.