De Financial Times meldde op 7 augustus 2026 dat ByteDance is begonnen met de voortraining van een groot taalmodel met maximaal 10 biljoen totale parameters . Voortraining duurt doorgaans drie tot zes maanden. Daarna volgen onder meer fijnafstemming, veiligheidstests en productintegratie, waardoor een eventuele publieke introductie nog geruime tijd op zich kan laten wachten .
De uiteindelijke omvang ligt nog niet vast. ByteDance onderzoekt nog of het model tot de volledige bovengrens van 10 biljoen parameters wordt getraind . Een eerder bericht van LatePost sprak diezelfde dag over een model met meer dan 5 biljoen parameters, wat erop kan wijzen dat de ambities later zijn uitgebreid .
Reuters kon de berichtgeving van de Financial Times niet onafhankelijk bevestigen . ByteDance heeft de details van het project niet publiekelijk bekendgemaakt.
Als de genoemde bovengrens klopt, zou ByteDance's model qua totale omvang in de buurt komen van Anthropic's Mythos 5. Branche-inschattingen plaatsen Mythos 5 op ongeveer 8 biljoen parameters . Ter vergelijking:
| Model | Geschat aantal parameters | Status |
|---|---|---|
| Nieuw model van ByteDance | Tot 10 biljoen | In de fase van voortraining; het grootste bekende Chinese model in ontwikkeling |
| Anthropic Claude Mythos 5 | Ongeveer 8 biljoen | Uitgebracht, maar de volledige mogelijkheden zijn beperkt tot geselecteerde organisaties |
| Moonshot AI Kimi K3 | 2,8 biljoen | Het model van ByteDance zou meer dan drie keer zo groot zijn |
| Vlaggenschip van OpenAI | Niet bekend; vermoedelijk meerdere biljoenen | OpenAI maakt het aantal parameters niet openbaar |
Een groter model is echter niet automatisch een beter model. Het aantal parameters is vooral een ruwe maat voor de omvang van de architectuur, niet voor de prestaties in bijvoorbeeld programmeren, redeneren of kenniswerk.
De gemelde 10 biljoen betreft totale parameters: alle parameters in de modelarchitectuur samen. Veel moderne AI-modellen gebruiken een zogenoemde Mixture-of-Experts-architectuur, waarbij per vraag slechts een deel van het model wordt geactiveerd.
Een model met 10 biljoen totale parameters kan daardoor bijvoorbeeld per verwerking aanzienlijk minder actieve parameters gebruiken. De beschikbare berichtgeving maakt niet duidelijk welk deel van ByteDance's model tijdens een afzonderlijke opdracht actief zou zijn. Zonder die informatie is een eerlijke vergelijking met Mythos 5 of andere modellen moeilijk .
ByteDance-oprichter Zhang Yiming zou het Seed-team hebben opgedragen om geen zogenoemde AI-distillatie toe te passen op de uitvoer van concurrerende modellen. Bij distillatie leert een kleiner of nieuw model van de antwoorden van een krachtiger model. Dat kan de ontwikkeling versnellen, maar ByteDance zou bereid zijn om daardoor op korte termijn achter binnenlandse concurrenten aan te lopen .
Volgens berichtgeving herhaalde Zhang dit standpunt tijdens een interne managementbijeenkomst rond 6 augustus 2026. Hij zou de keuze hebben gepresenteerd als een strategie van langetermijndenken en uitgestelde beloning: liever zelfstandig technische capaciteiten opbouwen dan snel betere scores behalen via een kortere route .
De beslissing staat bovendien tegen de achtergrond van ByteDance's ingewikkelde relatie met de Amerikaanse overheid, onder meer door de discussie rond TikTok. Zelfstandige ontwikkeling kan het bedrijf helpen om juridische en exportcontrole-risico's te beperken, al is niet duidelijk in hoeverre dat de doorslag gaf .
ByteDance richtte Seed begin 2023 op, kort nadat ChatGPT wereldwijd veel aandacht had gekregen . Volgens de berichtgeving bestaat de divisie uit ongeveer 2.000 medewerkers in China, waaronder onderzoekers, infrastructuuringenieurs en teams voor datalabeling .
De belangrijkste namen en organisatorische veranderingen:
Het project wordt gezien als een poging om de achterstand op Amerikaanse frontierlabs — met name Anthropic en OpenAI — te verkleinen . Die ambitie botst wel met de beperkingen op de toegang tot geavanceerde AI-chips. Door Amerikaanse exportcontroles moet ByteDance volgens de berichtgeving gebruikmaken van binnenlandse en eerder aangelegde hardwarevoorraden .
De benodigde infrastructuur zou op grote schaal worden uitgebreid. TechTimes beschreef die operatie als een bijna paramilitaire opschaling, waarbij Zhang Yiming zich persoonlijk zou bezighouden met de verdeling van rekenkracht . Dat beeld moet wel worden gezien als een karakterisering van de berichtgeving, niet als een officieel door ByteDance gebruikte omschrijving.
De timing is ook betekenisvol. De Chinese AI-sector kreeg nieuwe energie na de introductie van DeepSeek R1 in januari 2025, dat liet zien dat Chinese labs ondanks beperkingen op chips concurrerende resultaten kunnen behalen . Tegelijkertijd is Anthropic's Mythos 5 zelf onderdeel geworden van Amerikaanse veiligheidsdiscussies. De toegang tot de meest geavanceerde cyberbeveiligings- en biodefensiemogelijkheden werd in juni 2026 tijdelijk opgeschort en later gedeeltelijk hersteld voor geselecteerde organisaties .
Daarmee zijn frontiermodellen niet langer alleen commerciële producten. Ze worden steeds meer behandeld als strategische technologie.
ByteDance heeft nog niet gezegd of het nieuwe model publiek beschikbaar komt. De eerdere koers van het bedrijf wijst echter op een gesloten, productgerichte aanpak:
Als het model van 10 biljoen parameters wordt voltooid, ligt het daarom voor de hand dat ByteDance het inzet als onderliggende technologie voor Doubao en andere eigen producten. Een afzonderlijke open release is vooralsnog niet aangekondigd.
ByteDance doet met dit project een zeer grote langetermijninzet op AI die het zelf ontwikkelt. De omvang is indrukwekkend, maar de belangrijkste vragen zijn nog onbeantwoord: haalt het model daadwerkelijk 10 biljoen parameters, hoeveel daarvan worden per opdracht geactiveerd en levert de extra schaal ook betere prestaties op?
Voorlopig is dit dus vooral een signaal van ambitie. Het model zit nog in de vroege voortraining, de berichtgeving is niet volledig onafhankelijk bevestigd en zowel de planning als de uiteindelijke mogelijkheden blijven onzeker.