Ox Alpha oli Z.ai:n GLM 5.3 Flashin anonyymi esiversio, jonka yhtiö vahvisti 26. Malli päätti hetkeksi DeepSeekin 56 päivän valtakauden OpenCoden rankingin kärjessä ja keräsi poikkeuksellisen paljon käyttöä, mutta laajemmat DeepSWE testit sijoittivat sen lähemmäs Claude Opus 4.8:aa kuin osoittivat...
Research answer

Create a landscape editorial hero image for this Studio Global article: What is the anonymous AI model “Ox Alpha” (or “Niu Lai”), launched quietly on OpenRouter and OpenCode on August 20, 2026 and offered free fo. Article summary: Ox Alpha was a short anonymous “stealth” preview, not a still-unidentified new lab model: Z.ai subsequently identified it as GLM-5.3-Flash, a GLM-family model. Its strong early agentic-coding showing and unusually genero. Topic tags: general, general web, user generated, documentation. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks,
Ox Alpha oli lyhyen aikaa anonyyminä tarjolla ollut esiversio GLM-5.3-Flashista, joka kuuluu Z.ai:n GLM-malliperheeseen. Malli ilmestyi OpenRouteriin ja OpenCodeen 20. elokuuta 2026 palveluntarjoajan nimellä ”Stealth”. Se tarjosi 1 048 576 tokenin konteksti-ikkunan, tekstin, kuvien ja videon käsittelyn, työkalukutsut sekä esiversion ajan maksuttoman käytön. Z.ai vahvisti myöhemmin testanneensa GLM-5.3-Flashia anonyymisti nimellä ox-alpha ennen virallista julkaisua. 110
Tapauksesta tuli kiinnostava esimerkki siitä, kuinka jakelukanava, poikkeuksellisen avokätinen käyttöoikeus ja tekoälyagentteihin suunnatut ominaisuudet voivat tehdä mallista ilmiön jo ennen perinteistä mallikorttia tai virallisia vertailutuloksia.
Anonyymi listaus esitteli Ox Alphan päättelymallina, joka oli suunnattu ohjelmointiin, pitkäkestoiseen agenttityöskentelyyn ja tuotantokäyttöön. Ilmaisesiversion ominaisuudet olivat kunnianhimoiset:
stealth/ox-alphaOpenRouter ja OpenCode kuvasivat ilmaisen käyttöjakson hieman eri tavoin. OpenRouterin reittikohtainen ilmoitus viittasi lyhyempään ajanjaksoon, kun taas OpenCode puhui noin viikon mittaisesta jaksosta 20. elokuuta alkaen. Ilmaiskäytön karkea takaraja oli siis 24.–27. elokuuta, ei yksi kaikille reiteille yhteinen tarkka päättymispäivä. 2412
Miljoonan tokenin konteksti ei itsessään tee mallista parempaa, mutta se muuttaa sitä, millaisia työskentelytapoja kehittäjät voivat kokeilla. Koodausagentti voi pitää samassa istunnossa mukana suuremman osan koodivarastosta, työkalujen tulosteista, lokitiedoista ja visuaalisesta aineistosta ilman, että tietoja tarvitsee jatkuvasti tiivistää tai hylätä. Videotuki teki Ox Alphasta kiinnostavan myös käyttöliittymien testaamiseen ja muihin tekstipohjaista koodintuotantoa laajempiin tehtäviin. 343
Ox Alphan vetovoima oli ennen kaikkea käytännöllinen. Kehittäjät saivat kokeilla pitkän kontekstin multimodaalista koodausmallia, joka osasi käyttää työkaluja ja jonka tokenit eivät esiversion aikana maksaneet mitään. Tämä madalsi kokeilujen kynnystä erityisesti silloin, kun rakennettiin agentteja testaamaan koodivarastojen korjaamista, selainten käyttöä ja pitkiä ohjelmistokehitystehtäviä.
Mallin näkyvyys kasvoi nopeasti. Se katkaisi hetkeksi DeepSeekin 56 päivän putken OpenCoden rankingin kärjessä, ja raportit kertoivat poikkeuksellisesta yhden päivän kysyntäpiikistä. Julkaisun yhteydessä kiertäneitä käyttö- ja kapasiteettilukuja, kuten erittäin suuria tokenimääriä, ei kuitenkaan ole kaikkia riippumattomasti tarkastettu. Niitä on järkevämpää pitää merkkinä kovasta kiinnostuksesta kuin täsmällisinä tuotantomittareina. 114
Ero on tärkeä: ilmaisen kokeilun suosio mittaa yhtä aikaa mallin kyvykkyyttä, uutuutta, hintaa ja saatavuutta. Se ei yksin kerro, että kyseessä olisi kokonaisuutena paras järjestelmä.
Laajimmin jaettu varhainen väite oli 80 prosentin tulos DeepSWE-testissä: malli ratkaisi kahdeksan tehtävää kymmenestä. Se on rohkaiseva signaali, mutta kymmenen tehtävän otos on liian pieni vakaan ranking-sijoituksen perustaksi. Myöhemmässä, suuremmassa arvioinnissa tulos oli noin 63 prosenttia, ja Z.ai:n myöhemmin ilmoittama virallinen tulos GLM-5.3-Flashille oli 63,4 prosenttia DeepSWE v1.1 -testissä. 7634
Toisissa täyden testin arvioinneissa tulos jäi alemmaksi, esimerkiksi 58,4 prosenttiin 113 tehtävän joukossa. Arvioinnissa huomattavan osan epäonnistumisista kerrottiin liittyneen tulostemuotoon ja toteutukseen. Tämä havainnollistaa, kuinka herkkiä agenttien vertailut ovat testikehyksen asetuksille, työkalujen saatavuudelle, aikarajoille ja sille, miten onnistuminen määritellään. 4142
Varovaisin johtopäätös on siksi seuraava: Ox Alpha osoitti vahvaa koodausagentin suorituskykyä ja ylsi joissakin testeissä suljettujen huippumallien tuntumaan. Tulokset eivät kuitenkaan todista, että se olisi johdonmukaisesti päihittänyt Claude Fable 5:n tai kaikki muut kärkimallit.
Vertailuissa käytettiin eri tehtäväjoukkoja, agenttirakenteita ja arviointiolosuhteita. Varhainen kymmenen tehtävän otos saattoi tuottaa 80 prosentin tuloksen ilman, että se edusti koko benchmarkia. Noin 63 prosentin laajempi ajo kertoi toisenlaisen tarinan, ja 58,4 prosentin tulos saattoi sisältää lisärangaistuksia formaatti- tai testikehysongelmista.
DeepSWE-tiimin kerrottiin myöhemmin arvioineen mallin kokonaiskyvyn olevan lähempänä Claude Opus 4.8:n tasoa kuin osoittavan, että se olisi ylittänyt Claude Fable 5:n. 35 Vertailuluvut pitäisi siis esittää aina yhdessä otoksen, testiasetelman ja käytettyjen työkalujen kanssa – ei kohdella niitä yhden selkeän rankingin keskenään vaihtokelpoisina pisteinä.
Tunnettujen käyttäjien innostus sopi hyvin Ox Alphan työnkulkuun. Patrick Collison kuvaili mallia ”erittäin vaikuttavaksi” käytettyään sitä agenttikehyksen kautta. HermesAgentin perustaja puolestaan kertoi sen ylittäneen useita tiimin sisäisiä arviointikriteerejä. 3335
Tällaiset kokemukset ovat arvokkaita kuvauksia käytännön hyödyllisyydestä, etenkin koodaus- ja agenttitehtävissä. Ne eivät kuitenkaan ole sama asia kuin kontrolloitu, eri benchmarkit kattava osoitus siitä, että Ox Alpha olisi kaikissa tilanteissa parempi.
Malli voi olla erityisen hyödyllinen tietyssä työnkulussa pitkän kontekstin, työkalukutsujen toiminnan, nopeuden, multimodaalisuuden tai hinnan ansiosta, vaikka sen kokonaissijoitus vertailuissa olisi epäselvä.
Ennen virallista paljastusta tutkijat vertasivat Ox Alphan havaittavaa toimintaa Xiaomin MiMo-tiimin, Google DeepMindin ja Zhipu AI:n mahdollisiin malleihin.
Xiaomia pidettiin mahdollisena osittain siksi, että MiMo-tiimi oli aiemmin testannut anonyymiä ”Hunter Alpha” -mallia. Raporteissa kuitenkin huomautettiin kyvykkyyksien eroista: MiMo-malleihin liitettiin äänituki, kun taas Ox Alpha hyväksyi tekstiä, kuvia ja videota mutta ei ääntä. Xiaomi oli siis kiinnostava hypoteesi, ei vahva tunnistus. 2229
Googleen liittyvät vihjeet ja sosiaalisen median julkaisut ruokkivat lisäspekulaatiota, mutta saatavilla olevat merkit eivät osoittaneet, että DeepMind olisi rakentanut tai ylläpitänyt päätepistettä. Ne jäivät tilannekohtaisiksi vihjeiksi eivätkä tunnistavaksi todisteeksi.
Vahvin ennen paljastusta esitetty teoria viittasi Zhipun GLM-perheeseen. Yhteisön testeissä Ox Alphan tokenimäärien raportoitiin vastaavan GLM-5.3:n toimintaa erilaisilla kehotteilla. Poikkeama oli lähes vakio, noin 75 tokenia, mikä sopi näkymättömään järjestelmäkehotteeseen tai reitityksen lisäämään kääreeseen. Erillisissä videotesteissä tokenien kulutus vastasi GLM:n visiomalleja useiden koodausominaisuuksien osalta. 1821
Muita raportoituja vihjeitä olivat:
reasoning_effort-parametriin liittynyt virhe, joka muistutti GLM:n API-vastausta;Yksittäinen vihje olisi voinut johtua reitityksestä, ohjelmistokerroksista, yhteisestä infrastruktuurista tai jäljittelystä. Yhdessä ne tekivät GLM-teoriasta yhä vakuuttavamman, mutta eivät korvanneet virallista lausuntoa. Ratkaiseva todiste tuli, kun Z.ai tunnisti Ox Alphan GLM-5.3-Flashiksi ja julkaisi mallin virallisella nimellä. 1043
Paljastuksen jälkeen Ox Alpha ei enää ollut tekijänsä puolesta arvoitus vaan GLM-5.3-Flashin esiversio. Z.ai:n dokumentaatiossa mallia kuvataan hybridimalliksi, jossa on 320 miljardia kokonaisparametria ja 18 miljardia aktiivista parametria. Lisäksi siinä on natiivit visuaaliset ominaisuudet, joiden avulla malli voi tarkkailla käyttöliittymiä, renderöityjä tuloksia ja vuorovaikutuksen palautetta. Näin se voi muodostaa suljetun kehän koodin, selainten ja graafisten käyttöliittymien välille. 43
Virallinen julkaisu ratkaisi myös anonyymin päätepisteen keskeisen ongelman: jatkuvuuden epävarmuuden. Raporttien mukaan GLM-5.3-Flash julkaistiin MIT-lisenssillä, ja painot annettiin kehittäjien saataville, jos nämä haluavat hallita käyttöönottoa itse. 1950
Se ei kuitenkaan tarkoita, että jokainen käyttöönotto olisi automaattisesti turvallinen tai edullinen. Kehittäjien on edelleen arvioitava laitteistovaatimukset, päättelyn suorituskyky, API:n ehdot, yksityisyydensuoja, käyttörajat, työkalukutsujen luotettavuus ja tulosten tasaisuus omissa työkuormissaan.
Ilmainen esiversio synnytti huomion, mutta pitkäaikainen käyttö riippuu pysyvämmistä tuoteominaisuuksista:
Ox Alphan tärkein opetus ei ole yksinkertaisesti se, että anonyymi malli päihitti hetkeksi tunnetun kilpailijan. Olennaisempaa on, että kiinnostavasti suunniteltu työkalukokonaisuus voi levitä nopeasti, kun kehittäjät pääsevät testaamaan sitä laajasti.
Benchmark-tarina oli ensimmäisiä otsikoita varovaisempi, mutta taustalla oleva yhdistelmä – pitkä konteksti, multimodaalisuus, työkalujen käyttö, agenttimainen koodaus ja erittäin halpa pääsy – oli riittävän vahva herättääkseen huomion. Nyt kun identiteetti on ratkaistu GLM-5.3-Flashiksi, seuraava testi on, säilyykö yhdistelmä hyödyllisenä sen jälkeen, kun uutuudenviehätys ja ilmaisuus eivät enää kanna mallia.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Ox Alpha oli Z.ai:n GLM 5.3 Flashin anonyymi esiversio, jonka yhtiö vahvisti 26.
Ox Alpha oli Z.ai:n GLM 5.3 Flashin anonyymi esiversio, jonka yhtiö vahvisti 26. Malli päätti hetkeksi DeepSeekin 56 päivän valtakauden OpenCoden rankingin kärjessä ja keräsi poikkeuksellisen paljon käyttöä, mutta laajemmat DeepSWE testit sijoittivat sen lähemmäs Claude Opus 4.8:aa kuin osoittivat...
GLM 5.3 Flash säilyttää keskeiset vahvuudet: natiivin visuaalisen ymmärryksen, 320 miljardin kokonaisparametrin ja 18 miljardin aktiivisen hybridirakenteen sekä MIT lisenssin, joka mahdollistaa oman palvelimen käytön.