Namun, model ini belum siap digunakan publik. Proyeknya masih berada pada tahap awal, ukuran akhirnya belum ditetapkan, dan Reuters menyatakan belum dapat memverifikasi laporan Financial Times secara independen .
Menurut laporan Financial Times pada 7 Agustus 2026, ByteDance telah memulai pra-pelatihan model bahasa besar dengan kapasitas hingga 10 triliun parameter . Tahap pra-pelatihan biasanya memerlukan waktu sekitar tiga hingga enam bulan, sebelum model menjalani fine-tuning atau penyempurnaan untuk tugas tertentu dan kemungkinan dirilis .
Angka 10 triliun itu masih merupakan batas atas, bukan ukuran final yang sudah dipastikan. ByteDance masih mengevaluasi apakah model tersebut akan dilatih sampai mencapai kapasitas penuh. Laporan terpisah dari LatePost pada hari yang sama sebelumnya menyebut perusahaan tengah membahas model dengan lebih dari 5 triliun parameter, sehingga ada kemungkinan skala proyek ini diperluas .
Dengan kata lain, kabar yang beredar menunjukkan ambisi teknis yang sangat besar, tetapi belum membuktikan bahwa model 10 triliun parameter itu sudah selesai, sudah diuji, atau akan diluncurkan untuk umum.
Jika mencapai angka maksimum, model ByteDance akan berada di sekitar atau sedikit di atas estimasi ukuran Anthropic Claude Mythos 5. Berikut gambaran perbandingan berdasarkan angka yang tersedia:
| Model | Estimasi parameter | Status atau catatan |
|---|---|---|
| Model baru ByteDance | Hingga 10 triliun | Masih dalam tahap pra-pelatihan; berpotensi menjadi model terbesar yang pernah diupayakan perusahaan China |
| Anthropic Claude Mythos 5 | Sekitar 8 triliun | Sudah dirilis secara terbatas. Akses kemampuan penuhnya diberikan kepada organisasi AS yang telah lolos verifikasi melalui Project Glasswing |
| Moonshot AI Kimi K3 | 2,8 triliun | Target ByteDance akan lebih dari tiga kali lebih besar berdasarkan jumlah parameter total |
| Model unggulan OpenAI | Tidak diungkapkan | Diperkirakan berada pada kisaran beberapa triliun parameter |
Anthropic juga meluncurkan Claude Fable 5 untuk penggunaan yang lebih luas pada Juni 2026, dengan pembatasan keselamatan. Sementara itu, Mythos 5 tetap ditujukan untuk kelompok organisasi yang lebih terbatas karena kemampuannya di bidang seperti keamanan siber dan biologi .
Meski demikian, jumlah parameter bukan ukuran langsung dari kecerdasan atau kemampuan sebuah model. Parameter lebih tepat dipahami sebagai ukuran kasar dari skala arsitektur model.
Inilah catatan teknis yang paling penting. Angka yang dilaporkan untuk ByteDance adalah parameter total, yakni seluruh parameter yang terdapat dalam arsitektur model. Banyak model AI modern menggunakan arsitektur Mixture-of-Experts (MoE), yang tidak mengaktifkan semua parameter untuk setiap permintaan.
Sebagai contoh, model dengan 10 triliun parameter total mungkin hanya mengaktifkan sebagian kecilnya—misalnya sekitar 1 hingga 2 triliun parameter—ketika menghasilkan satu token atau jawaban. Laporan Financial Times dan pemberitaan lanjutan belum menjelaskan secara rinci apakah angka 10 triliun itu sepenuhnya merujuk pada parameter total, parameter aktif, atau kombinasi definisi tertentu .
Karena itu, membandingkan model ByteDance dengan Mythos 5 atau Kimi K3 hanya berdasarkan angka total dapat menghasilkan kesimpulan yang menyesatkan. Persentase parameter yang aktif, desain arsitektur, data pelatihan, efisiensi komputasi, serta hasil pengujian akan lebih menentukan kemampuan nyata model.
Pendiri ByteDance, Zhang Yiming, dilaporkan meminta tim Seed untuk tidak menggunakan distilasi model AI dari keluaran sistem pesaing, sekalipun keputusan itu membuat ByteDance tertinggal dalam jangka pendek .
Distilasi adalah metode ketika model yang lebih kecil atau model baru belajar dari keluaran model yang lebih besar dan lebih canggih. Cara ini dapat mempercepat pengembangan karena tim tidak harus membangun seluruh kemampuan dari awal.
Menurut laporan Reuters yang mengutip media China The Paper, Zhang menyampaikan bahwa pengembangan AI membutuhkan orientasi jangka panjang dan kesediaan menunda hasil—sebuah pendekatan yang kerap diringkas sebagai delayed gratification . Arahan tersebut menjadi pilihan strategis yang menonjol di tengah persaingan ketat, karena distilasi banyak digunakan untuk mempercepat peniruan kemampuan model frontier.
Keputusan itu juga dilaporkan berkaitan dengan hubungan regulasi ByteDance yang rumit dengan pemerintah AS, terutama terkait TikTok, serta keinginan perusahaan mengurangi risiko hukum dan risiko yang berhubungan dengan kontrol ekspor . Meski begitu, ByteDance belum memberikan konfirmasi publik yang lengkap mengenai seluruh detail kebijakan tersebut.
Proyek tersebut berada di bawah Seed, divisi riset AI fundamental ByteDance. Perusahaan membentuk Seed pada awal 2023, setelah kemunculan ChatGPT mendorong perusahaan teknologi besar mempercepat pengembangan model fondasi .
Beberapa detail penting mengenai timnya:
Skala tim tersebut menunjukkan bahwa proyek ini bukan sekadar eksperimen kecil. Namun, jumlah personel saja tidak menjamin model akan selesai sesuai target atau menghasilkan performa yang mampu menandingi model terbaik di dunia.
Ambisi 10 triliun parameter ByteDance muncul ketika pengembangan AI telah menjadi bagian dari persaingan teknologi dan keamanan nasional antara AS dan China. Proyek ini dipandang sebagai upaya langsung untuk mempersempit jarak dengan laboratorium frontier AS, terutama Anthropic dan OpenAI .
Konteks yang melingkupinya antara lain:
Perkembangan ini memperlihatkan bahwa model frontier tidak lagi dipandang hanya sebagai produk perangkat lunak. Kapasitas model, akses ke cip, infrastruktur komputasi, dan aturan penggunaannya semakin terkait dengan kepentingan strategis negara.
ByteDance belum mengumumkan apakah model 10 triliun parameter itu akan dirilis untuk publik atau dibuka kodenya. Sejauh ini, pendekatan perusahaan terhadap model unggulan cenderung tertutup dan terintegrasi ke dalam produk.
Produk AI konsumen ByteDance menggunakan merek Doubao (豆包), yang menggabungkan model fondasi dari keluarga Seed ke dalam layanan percakapan, asisten, dan pembuatan konten . Berbeda dengan Meta melalui Llama atau sejumlah pesaing China seperti DeepSeek, ByteDance tidak dikenal karena membuka kode model unggulan utamanya.
Prioritas AI ByteDance pada 2026 yang dikaitkan dengan kepemimpinan Wu Yonghui mencakup pengembangan world model, target membandingkan performanya dengan Genie 3 milik Google pada akhir 2026, pengembangan agen pemrograman Seedance, serta komersialisasi Doubao .
Jika proyek 10 triliun parameter selesai, model itu kemungkinan besar akan menjadi fondasi bagi Doubao dan produk internal ByteDance lainnya, bukan dirilis sebagai model terbuka yang berdiri sendiri. Namun, keputusan final mengenai akses publik, jadwal peluncuran, dan bentuk produknya belum diketahui.
ByteDance sedang memasang taruhan jangka panjang pada AI berskala frontier. Target hingga 10 triliun parameter akan menjadi pencapaian terbesar perusahaan China jika terealisasi, tetapi proyek tersebut masih berada di tahap awal dan ukuran akhirnya belum pasti.
Yang membuatnya penting bukan hanya angka besar itu. ByteDance juga memilih membangun kemampuan secara mandiri tanpa mengandalkan distilasi dari model pesaing, mengerahkan tim Seed sekitar 2.000 orang, dan mengembangkan proyek tersebut di tengah pembatasan cip serta persaingan teknologi AS-China. Seberapa kuat model ini nantinya baru dapat dinilai setelah pelatihan selesai, arsitektur dan parameter aktifnya diketahui, serta hasil pengujiannya tersedia.