Hankkeesta tiedetään kuitenkin vielä vähän varmasti. Malli on vasta esikoulutusvaiheessa, lopullista parametrimäärää ei ole päätetty, eikä ByteDance ole kertonut, julkaistaanko järjestelmä kuluttajien tai ulkopuolisten kehittäjien käyttöön. Reuters ei pystynyt vahvistamaan Financial Timesin raporttia itsenäisesti .
Financial Timesin 7. elokuuta 2026 julkaistun raportin mukaan ByteDance harjoittelee suurta kielimallia, jonka ylärajaksi on asetettu jopa 10 biljoonaa kokonaisparametria . Esikoulutus kestää tyypillisesti kolmesta kuuteen kuukautta, minkä jälkeen seuraavat hienosäätö, turvallisuustestit ja mahdollinen julkaisu .
Tämä tarkoittaa, ettei mallia kannata odottaa lähiaikoina yleiseen käyttöön. ByteDance arvioi edelleen, koulutetaanko malli täyteen 10 biljoonan parametrin kokoon. Aiempi LatePostiin perustunut raportti puhui yli 5 biljoonan parametrin mallista, joten hankkeen ilmoitettu mittakaava on saattanut kasvaa .
Jos ByteDance päätyy 10 biljoonan parametrin malliin, se olisi parametrimäärältään lähellä Anthropicille arvioitua Mythos 5 -mallia. Alan arviot sijoittavat Mythos 5:n noin 8 biljoonan parametrin kokoluokkaan .
| Malli | Arvioitu parametrimäärä | Tilanne |
|---|---|---|
| ByteDancen uusi malli | Enintään 10 biljoonaa | Esikoulutuksessa; suurin tunnettu kiinalaismallihanke |
| Anthropic Claude Mythos 5 | Noin 8 biljoonaa | Julkaistu rajoitetulle joukolle tarkastettuja yhdysvaltalaisorganisaatioita |
| Moonshot AI Kimi K3 | 2,8 biljoonaa | ByteDancen tavoite olisi yli kolme kertaa suurempi |
| OpenAI:n lippulaivamalli | Ei ilmoitettu; arvioitu useiden biljoonien luokkaan | Yhtiö ei ole julkaissut tarkkaa parametrimäärää |
Anthropic julkaisi kesäkuussa 2026 laajempaan käyttöön Claude Fable 5 -version, jossa herkimpien käyttöalueiden suojauksia on tiukennettu. Mythos 5:n rajoittamattomampia kykyjä on puolestaan tarjottu vain pienelle joukolle tarkastettuja kumppaneita Project Glasswing -ohjelman kautta .
Pelkkä parametrimäärä ei silti kerro suoraan mallin laadusta. Se on ennen kaikkea karkea kuvaus mallin arkkitehtuurin koosta.
Raportissa mainittu 10 biljoonaa viittaa kokonaisparametrimäärään. Monet nykyaikaiset suuret mallit käyttävät Mixture-of-Experts- eli MoE-arkkitehtuuria, jossa vain osa mallin parametreista aktivoituu yhden kyselyn käsittelyssä.
Teoriassa 10 biljoonan kokonaisparametrin mallissa voisi olla esimerkiksi vain 1–2 biljoonaa aktiivista parametria kutakin syötettä kohden. Lähteissä ei ole täsmennetty, viittaako ByteDancen luku kokonaisparametreihin, aktiivisiin parametreihin vai näiden yhdistelmään .
Tämä ero on olennainen, kun mallia verrataan Anthropicin, OpenAI:n tai muiden yhtiöiden järjestelmiin. Suurempi kokonaisluku ei automaattisesti tarkoita parempaa päättelykykyä, tehokkaampaa käyttöä tai parempia vastauksia.
ByteDancen perustaja Zhang Yiming on Reutersin mukaan ohjeistanut yhtiön Seed-tiimiä olemaan käyttämättä tekoälydistillointia kilpailijoiden mallien tuottamilla vastauksilla .
Distilloinnissa pienempi tai uusi malli opetetaan jäljittelemään suuremman niin sanotun opettajamallin vastauksia. Menetelmä voi nopeuttaa kehitystä, mutta se on samalla herättänyt kiistoja mallien koulutusdatasta, tekijänoikeuksista ja siitä, kuinka itsenäisesti uusi järjestelmä on kehitetty.
Zhangin kerrotaan hyväksyneen sen, että ByteDance saattaa jäädä lyhyellä aikavälillä kotimaisten kilpailijoidensa taakse. Hän on perustellut linjausta pitkäjänteisyydellä ja niin sanotulla viivästetyllä palkinnolla: hetkelliset tulokset ja vertailutaulukot eivät saisi mennä pitkän aikavälin oman tutkimuskyvyn edelle . Päätökseen vaikuttavat raporttien mukaan myös ByteDancen monimutkainen suhde Yhdysvaltain viranomaisiin TikTokin vuoksi sekä halu pienentää oikeudellisia ja vientivalvontaan liittyviä riskejä .
ByteDance perusti Seed-yksikön alkuvuodesta 2023 ChatGPT:n nousun jälkeen . Raporttien mukaan yksikössä työskentelee noin 2 000 ihmistä, mukaan lukien tutkijoita, infrastruktuuri-insinöörejä, datan merkitsijöitä ja kääntäjiä .
Hankkeen keskeisiä henkilöitä ovat:
Vuonna 2025 ByteDance yhdisti AI Lab -laboratorionsa ja robotiikkatiiminsä Seediin. Tavoitteena oli keskittää perustamallien tutkimus ja kehitys yhden organisaation alle .
ByteDancen hanke sijoittuu tilanteeseen, jossa Yhdysvallat rajoittaa kehittyneiden tekoälypiirien vientiä Kiinaan. Tämä pakottaa kiinalaisyhtiöt tukeutumaan kotimaisiin siruihin ja aiemmin hankittuun laitteistoon .
10 biljoonan parametrin mallin kouluttaminen vaatisi valtavan määrän laskentatehoa, datakeskuskapasiteettia ja energiaa. TechTimes kuvasi ByteDancen infrastruktuurin kasvattamista jopa puolisotilaallisen kaltaiseksi laajentumiseksi ja kertoi Zhang Yimingin osallistuneen henkilökohtaisesti laskentaresurssien kohdentamisen arviointiin .
Hanke kertoo samalla siitä, miten Kiinan tekoälyala yrittää kuroa kiinni yhdysvaltalaisia eturintaman laboratorioita. DeepSeek R1:n julkaisu tammikuussa 2025 osoitti, että kiinalaiset toimijat voivat saavuttaa kilpailukykyisiä tuloksia myös sirurajoitusten keskellä .
Myös Anthropicin Mythos 5 on joutunut osaksi Yhdysvaltojen kansallisen turvallisuuden keskustelua. Yhdysvaltain hallinto keskeytti mallin käytön lyhyeksi aikaa kesäkuussa 2026, minkä jälkeen pääsy palautettiin rajatulle joukolle niin sanottuja luotettuja organisaatioita . Kehittyneimmistä malleista on näin tullut paitsi kaupallisia tuotteita myös strategisia teknologioita.
ByteDance ei ole kertonut, aiotaanko 10 biljoonan parametrin malli julkaista avoimena mallina. Yhtiön tähänastinen toimintatapa on ollut suljettu ja vahvasti tuotteisiin integroitu.
ByteDancen kuluttajille suunnattu tekoälybrändi on Doubao (豆包), joka hyödyntää Seed-sarjan perustamalleja keskusteluissa, avustajatoiminnoissa ja sisällöntuotannossa . Yhtiö ei ole avannut lippulaivamallejaan samalla tavalla kuin Meta Llama-mallejaan tai jotkin kiinalaiset kilpailijat DeepSeek-mallejaan.
Vuoden 2026 painopisteisiin on raportoitu kuuluvan:
Jos 10 biljoonan parametrin malli valmistuu, se todennäköisesti toimii Doubaon ja muiden ByteDancen sisäisten tuotteiden taustalla sen sijaan, että yhtiö julkaisisi sen erillisenä avoimena mallina.
ByteDancen suunnitelma on ennen kaikkea mittava pitkän aikavälin panostus. Se pyrkii yhdistämään ennennäkemättömän suuren mallin, oman tutkimus- ja laskentainfrastruktuurin sekä strategian, jossa kilpailijoiden mallien suoria tuotoksia ei käytetä nopeana oikotienä.
Vielä ei kuitenkaan tiedetä, saavuttaako malli 10 biljoonan parametrin koon, milloin se valmistuu tai millaisiin tuloksiin se pystyy. Tässä vaiheessa kyse on suuresta kehityshankkeesta – ei valmiista tuotteesta eikä vielä todisteesta siitä, että ByteDance olisi todella saavuttanut Anthropicin tai OpenAI:n tason.