حصلت شركة "فوكسمايند" (Voxmind) الناشئة في لندن والمتخصصة في التكنولوجيا العميقة على تمويل أولي (Pre-Seed) بقيمة 546,491 جنيهًا إسترلينيًا لنشر منصتها المتخصصة للمصادقة الصوتية، وذلك في وقت ينسحب فيه أكبر مزودي الخدمات السحابية في العالم من هذا القطاع. قادت الجولة شركة Ascension Ventures بمشاركة مارك مكديرموت (المؤسس المشارك لـ ScreenCloud)، والمستثمر الملاك الرئيسي راسل هارت، وأعضاء من شبكة كامبريدج للمستثمرين الملائكة .
الشركة، التي تأسست في يناير 2024، تبني طبقة مصادقة لعصر الذكاء الاصطناعي لا تعتمد على الاتصال السحابي، مما يجعلها بديلاً مثالياً في توقيت حرج للشركات التي اضطرت للبحث عن موطن جديد لاحتياجاتها من القياسات الحيوية الصوتية .
غالبًا ما تحلل أنظمة الصوت التقليدية السطح الصوتي للكلام، والذي يمكن تقليده أو تركيبه. بدلاً من ذلك، تستخدم فوكسمايند محركًا لاستخراج تردد الفونيمات الصوتية (phoneme-frequency) حاصل على براءة اختراع، يقيس الخصائص الفيزيائية للتشريح الفريد للقناة الصوتية للمتحدث. ولأن المحرك يحلل العلاقة بين الفونيمات، فإن النظام مستقل عن النص ومستقل عن اللغة – فالمستخدم المسجل باللغة الإنجليزية لا يحتاج لإعادة التسجيل عند التحدث بالإسبانية .
يتيح هذا التصميم أيضًا مرونة هائلة في النشر. يمكن لمحرك المصادقة أن يعمل بالكامل على الجهاز نفسه أو على أجهزة الحافة (Edge) بدون الحاجة إلى وحدات معالجة رسوميات (GPUs) أو اتصالات سحابية دائمة . بالنسبة للشركات التي تتعامل مع بيانات مالية حساسة أو تعمل في بيئات ذات اتصال ضعيف، تحل هذه البنية مشكلة خصوصية وتأخير كبيرة في آن واحد.
مقاييس الأداء الأساسية طموحة: تتم المصادقة في أقل من ثانيتين، بدقة تصل إلى 99.9% ومعدل قبول خاطئ أقل من 0.1% . كما تم تبسيط عملية التسجيل لتستغرق من 3 إلى 5 ثوانٍ
.
أحد خيارات التصميم الجوهرية هو أن كشف التزييف العميق ليس ميزة إضافية. منذ مارس 2025، تم تفعيل كشف الصوت المُنشأ بالذكاء الاصطناعي بشكل افتراضي على جميع مكالمات التحقق عبر جميع الخطط .
الكاشف مبني على معمارية AASIST (اختصارًا لـ Audio Anti-Spoofing using Integrated Spectro-Temporal Graph Attention Networks)، وهي المعمارية التي فازت بتحدي ASVspoof 2021 – وهو المعيار الأكاديمي الرائد لمكافحة انتحال الصوت . يستهدف النظام استنساخ الصوت بالذكاء الاصطناعي، وهجمات الإعادة (replay attacks)، ومحاولات تحويل الصوت في الوقت الفعلي، مع معدل إيجابي خاطئ أقل من 0.1%. هذا يعني أن أقل من 1 من كل 1000 محاولة تحقق شرعية سيتم تصنيفها خطأً على أنها مزيفة
.
تدمج المنصة هذا مع سجل تدقيق غير قابل للحذف (append-only)، ولوحات معلومات تحليلية فورية، وتسليم النتائج عبر خطافات الويب (webhooks)، مما يمنح فرق الأمان سلسلة كاملة من الأدلة لكل عملية تحقق .
توقيت فوكسمايند ليس مصادفة. يمر قطاع القياسات الحيوية الصوتية بإعادة هيكلة جذرية مع انسحاب أو تراجع ثلاثة من عمالقة الحوسبة السحابية.
أوقفت مايكروسوفت خدمة Azure Speaker Recognition في سبتمبر 2025. وتوقفت AWS عن قبول عملاء جدد لـ Amazon Connect Voice ID وستنهي كل الدعم في 20 مايو 2026. وأزالت جوجل بهدوء مراجع منتج Speaker ID من موقعها الإلكتروني وأعادت توجيه الزوار من صفحة حل القياسات الحيوية الصوتية الخاص بها .
بالنسبة لشركات تصنيع الأجهزة (OEMs)، ومشغلي مراكز الاتصال، وشركات الخدمات المالية التي اعتمدت على هذه الخدمات كركيزة أساسية للمصادقة، لم يعد هناك خارطة طريق طويلة المدى من مزودي الخدمات السحابية الحاليين. وكما لاحظ مات سمالمان، مؤسس شركة SymNex Consulting، فإن فريق Nuance الأصلي الذي بنى جزءًا كبيرًا من قدرات مايكروسوفت في القياسات الحيوية الصوتية قد رحل إلى حد كبير، وتلاشت المعرفة المؤسسية .
يتزامن هذا الانسحاب مع نمو هائل في استنساخ الصوت المدعوم بالذكاء الاصطناعي. أصبحت عينة صوتية مدتها 3 ثوانٍ كافية الآن لاستنساخ صوت باستخدام أدوات متاحة مجانًا، مما يجعل القنوات الصوتية غير المحمية ناقل احتيال سريع النمو . من المتوقع أن يصل سوق القياسات الحيوية الصوتية العالمي إلى 22.76 مليار دولار بحلول عام 2034، بمعدل نمو سنوي مركب (CAGR) يبلغ 25.88% من قاعدة 3.61 مليار دولار في عام 2026 – وهي إشارة إلى أن الشركات تبحث بنشاط عن مزودين جدد ومتخصصين
.
صممت فوكسمايند منصتها لتلائم الشركات أينما كانت في رحلة الترحيل. تخدم واجهة برمجة تطبيقات (API) واحدة قنوات الويب، والهاتف المحمول، والرد الصوتي التفاعلي (IVR)، ووكلاء الذكاء الاصطناعي الصوتي، مع خيارات نشر عبر السحابة، وعلى أجهزة الحافة، وبشكل كامل على الجهاز .
تستهدف الشركة بنشاط ثلاث قطاعات رئيسية في خطتها للذهاب إلى السوق :
يشمل نموذج شراكات فوكسمايند مسارين: شركاء التكنولوجيا الذين يدمجون المنصة في منتجاتهم الخاصة، وشراكات OEM والأنظمة المدمجة التي تضع المحرك مباشرة في الأجهزة ومنتجات الطرف الثالث .
بالنسبة للشركات في منتصف رحلة الترحيل، فإن العرض واضح: طبقة مصادقة صوتية متخصصة تعمل على الجهاز، وتعمل بأي لغة، وتكشف استنساخ الذكاء الاصطناعي بشكل افتراضي، ولا تتطلب اتصالاً سحابيًا – مبنية من قبل شركة مكرسة بالكامل لهذه المشكلة، في لحظة ينسحب فيها العمالقة.
Studio Global AI
Use this topic as a starting point for a fresh source-backed answer, then compare citations before you share it.
أغلقت فوكسمايند جولة تمويل أولية بقيمة 546,491 جنيهًا إسترلينيًا بقيادة Ascension Ventures لبناء نظام مصادقة صوتية يعمل على الجهاز، ويحلل التشريح الفيزيائي للقناة الصوتية للمتحدث، ويكشف التزييف العميق بالذكاء الاصطناعي.
أغلقت فوكسمايند جولة تمويل أولية بقيمة 546,491 جنيهًا إسترلينيًا بقيادة Ascension Ventures لبناء نظام مصادقة صوتية يعمل على الجهاز، ويحلل التشريح الفيزيائي للقناة الصوتية للمتحدث، ويكشف التزييف العميق بالذكاء الاصطناعي. يأتي التمويل بعد تقاعد مايكروسوفت لخدمة Azure Speaker Recognition في سبتمبر 2025، وإنهاء AWS لدعم Amazon Connect Voice ID في مايو 2026، مما يخلق فراغًا هيكليًا للشركات في قطاعات الخدمات المالية والاتصالات ومراكز الاتصال.
تقوم تقنية الشركة الناشئة الحاصلة على براءة اختراع، والمستقلة عن اللغة، بمصادقة المستخدمين في أقل من ثانيتين بدقة 99.9%، وكاشف التزييف العميق المدمج، الفائز بتحدي ASVspoof 2021، هو ميزة افتراضية في كل عملية تحقق.