OpenCode ने भी अपने मुफ्त टियर के जरिए Ox Alpha की सुविधा दी। उसके ऐलान में उदार सीमाओं और “लगभग असीमित उपयोग” की बात कही गई, साथ ही प्रतिदिन 100 ट्रिलियन टोकन की क्षमता का दावा किया गया। यह ऑपरेटर का दावा है, स्वतंत्र रूप से ऑडिट की गई थ्रूपुट माप नहीं।
डेवलपर Ben Davis ने DeepSWE सॉफ्टवेयर-इंजीनियरिंग बेंचमार्क से चुने गए 10 टास्क पर Ox Alpha का परीक्षण किया। रिपोर्ट के अनुसार मॉडल ने इनमें से 8 टास्क पास किए, यानी इसका परिणाम लगभग 80% रहा। इसी सीमित तुलना में Claude Fable 5 का स्कोर 65% और GPT-5.6 Sol का 52% था।
यह आंकड़ा प्रभावशाली जरूर है, लेकिन इसे आधिकारिक DeepSWE जीत कहना सही नहीं होगा। DeepSWE v1.1 में 91 रिपॉजिटरी और पांच प्रोग्रामिंग भाषाओं से जुड़े 113 मूल, लंबे सॉफ्टवेयर-इंजीनियरिंग टास्क हैं। 10 टास्क का प्रयोग पूरे बेंचमार्क का बहुत छोटा हिस्सा था।
इस तुलना की कुछ अहम सीमाएं भी हैं:
उस समय उपलब्ध सार्वजनिक लीडरबोर्ड स्नैपशॉट में Claude Opus 5 सबसे आगे 73.6% पर था। इसके बाद GPT-5.6 Sol 72.7% और Claude Fable 5 69.7% पर थे। इसलिए सावधानी से निकाला जाने वाला निष्कर्ष यह है कि Davis के 10-टास्क प्रयोग में Ox Alpha बेहद मजबूत दिखा, लेकिन इससे यह साबित नहीं होता कि वह सबसे अच्छा सामान्य-उद्देश्य कोडिंग मॉडल है।
सबसे प्रमुख पहचान-सिद्धांत Ox Alpha को Zhipu AI, यानी Z.ai, और उसके GLM मॉडल परिवार से जोड़ता है। यह निष्कर्ष कंपनी की घोषणा पर नहीं, बल्कि मॉडल के व्यवहार और तकनीकी फिंगरप्रिंट की तुलना पर आधारित है।
एक रिपोर्ट किए गए परीक्षण में 25 अलग-अलग प्रॉम्प्ट के जरिए Ox Alpha और GLM-5.3 के टोकनाइजेशन व्यवहार की तुलना की गई। बताया गया कि एक स्थायी 75-टोकन रैपर का हिसाब लगाने के बाद दोनों के मूल टोकन काउंट मेल खाते थे। अलग-अलग वीडियो परीक्षणों में भी विजुअल-टोकन व्यवहार समान पाया गया—जिसमें फ्रेम सैंपलिंग, अवधि के हिसाब से स्केलिंग और रिजॉल्यूशन संभालने के तरीके शामिल थे।
अन्य रिपोर्टों में जवाब देने की शैली, API व्यवहार और ऑडियो इनपुट संभालने के तरीके में भी समानताएं बताई गई हैं। इनमें से किसी एक संकेत की व्याख्या साझा रैपर, समान इन्फ्रास्ट्रक्चर या नकल से की जा सकती है। लेकिन विश्लेषकों का तर्क है कि कई संकेतों का एक साथ मेल Zhipu की एकीकृत मल्टीमॉडल GLM लाइन के अनुरूप दिखाई देता है।
Zhipu का पहले गुमनाम या स्टील्थ अंदाज में मॉडल जारी करने का इतिहास भी इस सिद्धांत को कुछ संदर्भ देता है। इसमें Pony Alpha नाम से किए गए पिछले परीक्षण शामिल हैं। फिर भी इससे यह साबित नहीं होता कि Ox Alpha Zhipu ने ही बनाया है।
रिपोर्टों में शामिल अवधि के दौरान किसी कंपनी ने सार्वजनिक रूप से Ox Alpha पर अपना दावा नहीं किया था और Zhipu ने भी इस पहचान की पुष्टि नहीं की थी। कुछ अटकलें विशेष GLM वेरिएंट की ओर इशारा करती हैं, लेकिन उपलब्ध सबूत यह तय नहीं करते कि Ox Alpha कोई अप्रकाशित मॉडल है, प्रोडक्शन वेरिएंट है, फाइन-ट्यून किया गया सिस्टम है या संबंधित इन्फ्रास्ट्रक्चर पर चलाया जा रहा स्वतंत्र मॉडल।
इसलिए सबसे बचाव योग्य विवरण यह है: Ox Alpha संभवतः GLM-आधारित है और इसका Zhipu से संबंध हो सकता है, लेकिन इसके निर्माता और सटीक मॉडल पहचान की पुष्टि नहीं हुई है। अलग-अलग विश्लेषकों द्वारा साझा किए गए भरोसे के प्रतिशत को आधिकारिक पहचान नहीं माना जाना चाहिए।
डेवलपर्स के लिए Ox Alpha की प्राइवेसी भाषा सबसे महत्वपूर्ण व्यावहारिक पहलुओं में से एक है। OpenRouter की मॉडल लिस्टिंग में कहा गया था कि प्रॉम्प्ट और जवाब मूल प्रदाता के पास सुरक्षित रखे जाते हैं, लेकिन उनका इस्तेमाल ट्रेनिंग के लिए नहीं किया जाता।
यह OpenRouter की सामान्य डेटा-कलेक्शन नीति से अलग बात है। OpenRouter के अनुसार वह खुद प्रॉम्प्ट या जवाब सुरक्षित नहीं रखता, जब तक उपयोगकर्ता इनपुट/आउटपुट लॉगिंग के लिए सहमति न दे। OpenRouter प्रदाता-स्तर की नीतियों को अलग से दर्ज करता है, इसलिए रूटिंग लेयर और मॉडल प्रदाता के डेटा-रिटेंशन नियम अलग हो सकते हैं।
दूसरी ओर, OpenCode ने Ox Alpha को “जीरो डेटा रिटेंशन” के साथ प्रचारित किया। यह दावा OpenCode की अपनी अनुरोध-प्रसंस्करण व्यवस्था पर लागू हो सकता है, लेकिन इससे OpenRouter रूट पर जुड़े मॉडल प्रदाता की डेटा-रिटेंशन जानकारी अपने-आप खत्म नहीं हो जाती। सरल शब्दों में, “OpenCode डेटा नहीं रखता” और “मॉडल प्रदाता प्रॉम्प्ट और जवाब रखता है”—दोनों बातें एक ही अनुरोध-श्रृंखला के अलग-अलग चरणों के बारे में हो सकती हैं।
जब तक प्रदाता एक स्पष्ट और अनुबंध-आधारित डेटा-प्रोसेसिंग नीति प्रकाशित नहीं करते, सुरक्षित अनुमान यही है कि मॉडल प्रदाता भेजी गई सामग्री को रख सकता है। केवल इसलिए कि सेवा मुफ्त है या प्रॉम्प्ट से ट्रेनिंग नहीं करने की बात कही गई है, डेवलपर्स को अपना निजी सोर्स कोड, क्रेडेंशियल, व्यक्तिगत डेटा या विनियमित जानकारी इसमें नहीं भेजनी चाहिए।
Ox Alpha तीन वजहों से चर्चा में आया: सीमित अवधि का मुफ्त प्रीव्यू, लगभग दस लाख टोकन की संदर्भ-विंडो के साथ मल्टीमॉडल क्षमताएं और शुरुआती कोडिंग टेस्ट में मिला चौंकाने वाला परिणाम। फिर भी उपलब्ध सबूतों से यह कहना जल्दबाजी होगी कि किसी अज्ञात लैब ने निश्चित रूप से स्थापित फ्रंटियर मॉडलों को हरा दिया।
80% DeepSWE आंकड़ा 10 में से 8 सफल टास्क पर आधारित था, पूरे 113-टास्क बेंचमार्क पर नहीं। सार्वजनिक लीडरबोर्ड में Claude Opus 5 आगे था और Ox Alpha ने आधिकारिक मूल्यांकन प्रक्रिया पूरी नहीं की थी।
इसके तकनीकी फिंगरप्रिंट Zhipu/GLM कनेक्शन को सबसे प्रमुख व्याख्या बनाते हैं, लेकिन किसी सार्वजनिक पुष्टि से इसकी लेखकीय पहचान स्थापित नहीं हुई। प्रयोग के लिए Ox Alpha एक दिलचस्प मॉडल था; मगर प्रोडक्शन सिस्टम या संवेदनशील कोड के लिए इसकी गुमनाम स्वामित्व-संरचना, प्रदाता-स्तर का डेटा-रिटेंशन और अनसुलझी पहचान सावधानी बरतने की पर्याप्त वजह हैं।