الترجمة بين الإنجليزية والفيتنامية ليست مهمة واحدة ثابتة. أداة قد تعطي نتيجة جيدة في الأخبار أو الرسائل اليومية، لكنها تتعثر في عقد قانوني أو دليل تقني. وأداة أخرى قد تنتج نصًا فيتناميًا سلسًا لكنها تغيّر نفيًا أو رقمًا أو علاقة شرطية. كذلك قد يختلف الأداء بين اتجاهي الترجمة: من الإنجليزية إلى الفيتنامية، أو من الفيتنامية إلى الإنجليزية.
لذلك، قبل البحث عن «رقم واحد»، اسأل:
من دون هذه الأسئلة، قد يكون أي ترتيب عام مضللًا أكثر مما هو مفيد.
تصف Meta مشروع FLORES بأنه مجموعة بيانات Benchmark للترجمة الآلية بين الإنجليزية ولغات أقل تمثيلًا في البيانات، وهدفه تقديم معيار واقعي وعملية تقييم عادلة وصارمة للترجمة الآلية متعددة اللغات.
هذا يجعل FLORES مفيدًا جدًا عند بناء اختبار أو قراءة نتائج Benchmark. لكنه، بحد ذاته، ليس ترتيبًا مستقلًا يقول إن Google Translate أو DeepL أو ChatGPT أو أي API آخر هو الأفضل في زوج English↔Vietnamese.
بمعنى أبسط: FLORES يساعدنا على فهم طريقة التقييم، لكنه لا يختار لك الأداة المناسبة اليوم.
ينص Benchmark 2026 المنشور من TranslatePlus على أنه قارن TranslatePlus مع DeepL وGoogle Translate وMicrosoft Azure Translator، مستخدمًا مجموعة FLORES ومؤشري BLEU وCOMET. يشرح المصدر أن BLEU يميل إلى قياس الدقة اللفظية، بينما يعكس COMET جودة المعنى الدلالي.
في النتائج المذكورة، حقق اتجاه English→Vietnamese نتيجة BLEU 42.38 وCOMET 0.910. هذه أرقام تستحق الانتباه، لكنها لا تكفي وحدها لإعلان فائز عام، لثلاثة أسباب:
إذًا، يمكن اعتبار هذه الأرقام إشارة مفيدة، لا حكمًا نهائيًا.
تقدم DeepL نفسها على صفحة المنتج بوصفها «the world’s most accurate translator»؛ أي «المترجم الأكثر دقة في العالم». هذا ادعاء تسويقي مهم من شركة كبيرة في مجال الترجمة، لكنه ليس اختبارًا مستقلًا خاصًا بزوج الإنجليزية والفيتنامية.
عمليًا، يمكن أن تضع DeepL ضمن قائمة الأدوات التي تستحق التجربة، لكن لا ينبغي اعتبار العبارة وحدها دليلًا حاسمًا.
هناك مصدر آخر يقارن Google Translate وDeepL وChatGPT في دقة الترجمة الآلية لعام 2026، ويشير إلى Benchmarks ودرجات BLEU. لكن المعلومات المتاحة من هذا المصدر لا تكفي لاستخلاص ترتيب مستقل وواضح ومباشر خاص بزوج English↔Vietnamese.
الخلاصة هنا: Google Translate وDeepL وChatGPT وMicrosoft/Azure Translator وأدوات API المتخصصة كلها مرشحة للتجربة. لكن شهرة الاسم لا تغني عن اختبارها على نصوصك الفعلية.
بدل الاعتماد على شعار أو ترتيب عام، يمكنك إجراء اختبار صغير لكنه مفيد. لا تحتاج إلى دراسة ضخمة؛ يكفي أن تستخدم عينات حقيقية من النصوص التي تعمل عليها.
لا تستخدم جملًا عامة وسهلة فقط. اختر جملًا تمثل الاستخدام الحقيقي، مثل:
إذا كنت تترجم في الاتجاهين، أنشئ اختبارين منفصلين: واحدًا لـ English→Vietnamese وآخر لـ Vietnamese→English. لا تفترض أن نجاح الأداة في اتجاه واحد يعني نجاحها في الاتجاه الآخر.
اختر 3 إلى 5 أدوات تدخل فعلًا في خياراتك، مثل Google Translate أو DeepL أو ChatGPT أو Microsoft/Azure Translator أو API ترجمة متخصص وارد في المقارنات المتاحة.
بعد ذلك، أخفِ اسم الأداة عند التقييم. التقييم العمياء يقلل تأثير العلامة التجارية أو الواجهة أو الانطباع المسبق.
| المعيار | السؤال الأساسي | درجة مقترحة |
|---|---|---|
| دقة المعنى | هل حافظت الترجمة على المعلومات والنفي والأرقام والعلاقات المنطقية؟ | 1–5 |
| طبيعية الأسلوب | هل تبدو الجملة طبيعية في الفيتنامية أو الإنجليزية بحسب السياق؟ | 1–5 |
| المصطلحات | هل تُرجمت المصطلحات المهمة بدقة واتساق؟ | 1–5 |
| الأخطاء الخطرة | هل أضافت الأداة معنى غير موجود، أو حذفت معنى مهمًا، أو اختلقت تفصيلًا؟ | 1–5 |
في النصوص عالية الحساسية، مثل العقود أو المواد الطبية أو المالية أو التقنية أو المحتوى الرسمي المنشور، من الأفضل إضافة مراجعة بشرية من شخص يعرف المجال.
إذا كانت أداة ما تكتب بأسلوب سلس لكنها تضيف أو تحذف معاني، فهي مخاطرة في النصوص التي تتطلب دقة. وإذا كانت أداة أخرى تحافظ على المعنى لكن أسلوبها جامد، فقد تصلح كمسودة أولى تحتاج تحريرًا. وإذا كانت المشكلة الأساسية في المصطلحات، جرّب قاموس مصطلحات، أو تعليمات Prompt أكثر وضوحًا، أو مرحلة مراجعة بعد الترجمة.
اختيارك يجب أن يتبع الاستخدام:
ضمن المصادر المتاحة، لا توجد أدلة مستقلة قوية تكفي لتسمية أداة ذكاء اصطناعي واحدة بوصفها الأفضل في ترجمة الإنجليزية↔الفيتنامية. FLORES يوفر أساسًا مهمًا لتقييم الترجمة الآلية متعددة اللغات، وBenchmark TranslatePlus يقدم أرقامًا مرجعية لاتجاه English→Vietnamese، أما ادعاء DeepL فهو ادعاء منتج وليس تحققًا مستقلًا خاصًا بهذا الزوج اللغوي.
إذا كنت تحتاج إلى قرار الآن، لا تختر بناءً على الشعار. اختبر 20–30 جملة من مجالك وبطريقة عمياء. الأداة التي تحقق أفضل نتيجة على نصوصك الحقيقية، وفي اتجاه الترجمة الذي تحتاجه، ووفق مستوى المخاطر لديك، هي الخيار الأكثر موثوقية لك.