Alibaba melancarkan Qwen2.5 Max pada 28–29 Januari 2025 sebagai model Qwen terbesar dan paling berkeupayaan pada ketika itu. Model campuran pakar (MoE) ini dilatih menggunakan lebih 20 trilion token, kemudian diperkemas melalui supervised fine tuning dan reinforcement learning daripada maklum balas manusia.
Research answer

Create a landscape editorial hero image for this Studio Global article: How did Alibaba Cloud’s January 2025 launch of Qwen2.5 Max—its most advanced large language model at the time—intensify competition among fr. Article summary: Alibaba’s Qwen2.5 Max launch signaled that Chinese developers could rapidly produce near frontier models and deploy them through major cloud platforms, putting pressure on both Western closed model pricing and Chinese ri. Topic tags: general web, openai, llm, agents, ai. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
Pelancaran Qwen2.5-Max oleh Alibaba pada Januari 2025 menandakan bahawa pembangun AI China mampu menghasilkan model hampir setara dengan barisan hadapan global dalam tempoh yang singkat. Lebih penting, Alibaba menggabungkan dakwaan prestasi kompetitif dengan pengedaran melalui platform awan dan ekosistem model yang semakin terbuka. Gabungan ini meningkatkan tekanan terhadap model proprietari Barat yang mahal serta pesaing China seperti DeepSeek. 512
Alibaba mengumumkan Qwen2.5-Max pada 28–29 Januari 2025 sebagai model Qwen terbesar dan paling berkeupayaan pada ketika itu. Ia ialah model bahasa besar berasaskan mixture of experts (MoE) yang dilatih awal menggunakan lebih 20 trilion token, sebelum melalui supervised fine-tuning (SFT) yang disusun secara terpilih dan reinforcement learning daripada maklum balas manusia (RLHF). 512
Dalam seni bina MoE, model mempunyai banyak “pakar”, tetapi hanya sebahagian daripadanya diaktifkan bagi setiap permintaan. Pendekatan ini berpotensi meningkatkan kapasiti keseluruhan model tanpa memerlukan semua parameter digunakan pada setiap inferens. Hasilnya, kos dan kecekapan operasi boleh menjadi lebih baik berbanding model padat yang mempunyai keupayaan setara.
Namun begitu, pengumuman Alibaba tidak memberikan perincian seni bina yang mencukupi untuk mengesahkan secara bebas jumlah parameter keseluruhan atau jumlah parameter aktif Qwen2.5-Max. Jadi, angka khusus tentang saiz model wajar dielakkan jika tidak disokong oleh dokumentasi teknikal yang jelas.
Qwen2.5-Max juga tidak sama dengan semua model Qwen2.5 yang boleh dimuat turun. Keluarga Qwen2.5 yang lebih luas merangkumi model asas dan model yang ditala untuk arahan, daripada 0.5B hingga 72B parameter, termasuk versi terkuantum. Model-model ini diedarkan melalui Hugging Face, ModelScope dan Kaggle. Sebaliknya, Qwen2.5-Max pada peringkat awal ditawarkan sebagai perkhidmatan terhos, bukan model dengan berat yang boleh dimuat turun. 1
Akses awal diberikan melalui API Alibaba Cloud Model Studio serta antara muka sembang dan produk berkaitan Qwen. Ini menjadikan pelancaran tersebut serentak sebagai keluaran teknologi dan usaha menggalakkan penggunaan perkhidmatan awan. 1
Alibaba mendakwa Qwen2.5-Max mempunyai prestasi kira-kira setanding dengan Claude 3.5 Sonnet dalam beberapa penilaian, selain mengatasi GPT-4o, DeepSeek-V3 dan Llama 3.1 405B dalam “hampir semua” penilaian. Itu ialah dakwaan vendor, bukannya bukti bahawa model tersebut unggul dalam setiap tugasan atau keadaan produksi. 5
Syarikat itu menekankan penilaian yang menguji pengetahuan sukar, pengekodan dan keupayaan umum, termasuk MMLU-Pro, GPQA-Diamond, LiveCodeBench, LiveBench dan Arena-Hard. Profil ini meletakkan Qwen2.5-Max dalam persaingan langsung untuk tugasan matematik, penaakulan, pengaturcaraan dan pembantu perusahaan. 12
Menurut laporan mengenai papan pendahulu Chatbot Arena pada awal Februari 2025, Qwen2.5-Max memperoleh skor 1332 dan berada di tempat ketujuh secara keseluruhan. Laporan sama menyatakan bahawa model itu mendahului kategori matematik dan pengekodan, serta berada di tempat kedua untuk gesaan sukar. Ini ialah petunjuk luaran bahawa pengguna memberikan keutamaan tinggi terhadap jawapannya, tetapi Chatbot Arena tetap merupakan papan pendahulu yang berubah-ubah dan sensitif kepada jenis gesaan. Ia bukan ukuran menyeluruh bagi kebolehpercayaan, keselamatan, keupayaan ejen atau kesesuaian perusahaan. 1012
Kesimpulan yang paling berhati-hati ialah Qwen2.5-Max merupakan pencabar hampir frontier yang kredibel. Namun, kenyataan bahawa ia secara muktamad “mengalahkan” GPT-4o, Claude 3.5 Sonnet atau DeepSeek-V3 perlu kekal dinisbahkan kepada Alibaba dan dihadkan kepada penanda aras tertentu. 5
Keluarga Qwen2.5 yang lebih luas menyokong pelbagai bahasa dan kegunaan berasaskan kod. Perkembangan ini penting untuk organisasi yang memerlukan penyetempatan di luar fokus bahasa Inggeris yang lazim dalam banyak perkhidmatan model frontier. 1
Strategi Alibaba menggabungkan dua pendekatan: model flagship berprestasi tinggi yang dihoskan secara proprietari, serta pelbagai model terbuka untuk dimuat turun, diubah suai, ditala dan dihoskan sendiri oleh pembangun. Menurut laporan teknikal Qwen2.5, lebih 100 model dan varian boleh diakses melalui repositori awam. 1
Model terbuka membantu membina komuniti pembangun, integrasi dan sokongan perkakasan. Pada masa yang sama, Model Studio menyediakan API terurus, alat penggunaan dan saluran pendapatan perusahaan. Dengan kata lain, Alibaba tidak perlu memilih antara keterbukaan model dan perniagaan awan — kedua-duanya boleh saling mengukuhkan.
Sokongan perkakasan turut memperluas strategi itu. Alibaba kemudiannya mempromosikan varian Qwen3 terkuantum untuk peranti Apple dan sokongan model Qwen3 pada perkakasan AMD Instinct. Ini membantu mengurangkan pergantungan kepada satu penyedia awan atau satu rangkaian pemecut AI. 15
Pada April 2025, Alibaba melancarkan Qwen3 sebagai generasi baharu keluarga model bahasa besarnya yang bersumber terbuka. Siri itu merangkumi enam model padat daripada 0.6B hingga 32B parameter serta dua model MoE, termasuk model dengan 235B parameter keseluruhan dan 22B parameter aktif. 78
Peralihan daripada Qwen2.5-Max kepada Qwen3 memperlihatkan strategi hibrid Alibaba dengan lebih jelas: mengekalkan tawaran berprestasi tinggi yang dihoskan untuk mengawal akses dan pengewangan, sambil melepaskan rangkaian model terbuka yang luas bagi merebut perhatian pembangun dan organisasi di seluruh dunia. 78
Model Studio pula menjadi lapisan terurus bagi portfolio yang berkembang ini. Dengan cara tersebut, kemajuan model boleh ditukar kepada penggunaan awan dan hasil API, bukan sekadar bergantung pada jualan terus model proprietari.
Qwen2.5-Max muncul tidak lama selepas DeepSeek-V3 mendapat perhatian global. Respons Alibaba menjadikan perkembangan AI China kelihatan kurang seperti kejayaan sebuah syarikat tunggal dan lebih seperti persaingan antara beberapa pemain yang mempunyai keupayaan teknikal serta saluran pengedaran tersendiri. 5
Persaingan ini bukan hanya tentang siapa mendapat skor tertinggi dalam satu ujian. Model yang “cukup baik” untuk pengekodan, sokongan pelanggan, terjemahan, carian berasaskan dokumen dan pembantu dalaman boleh menggantikan model premium dalam tugasan perusahaan yang melibatkan jumlah penggunaan tinggi — terutama jika harganya lebih rendah, boleh diakses melalui API atau boleh dijalankan menggunakan berat terbuka.
Keadaan ini memberi tekanan kepada penyedia model frontier seperti Anthropic untuk membuktikan nilai tambahan melalui kelebihan prestasi yang berkekalan, keselamatan dan kebolehpercayaan yang lebih baik, penggunaan alat yang lebih mantap, sokongan konteks panjang, kawalan perusahaan serta kualiti perkhidmatan. Laporan mutakhir juga menggambarkan model China sebagai semakin hampir dari segi keupayaan sambil bersaing dengan agresif dari segi kos. 61119
Kemungkinan besar hasilnya bukan penggantian serta-merta, tetapi pembahagian pasaran. Pengguna dengan tugasan paling kritikal mungkin terus membayar model proprietari Barat yang terkuat. Pada masa yang sama, organisasi yang lebih sensitif terhadap kos, privasi data atau kedaulatan teknologi mungkin semakin memilih model China dan model terbuka.
Tiada bukti yang cukup kukuh bahawa “Ox Alpha” ialah model frontier China yang telah didokumentasikan dan dilancarkan secara rasmi, setanding dengan DeepSeek-V3 atau Qwen2.5-Max. Oleh itu, nama tersebut wajar dianggap sebagai label yang belum disahkan atau spekulatif, bukan bukti dalam menilai keupayaan AI China.
Kesimpulan yang lebih besar tidak bergantung pada “Ox Alpha”. Qwen, DeepSeek, Moonshot, Z.ai dan pemain lain telah menjadikan persaingan AI frontier semakin multipolar. Dalam landskap baharu ini, berat model terbuka, seni bina MoE yang cekap, API awan dan kos operasi rendah bukan lagi ciri sampingan — semuanya menjadi senjata persaingan utama. 67
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba melancarkan Qwen2.5 Max pada 28–29 Januari 2025 sebagai model Qwen terbesar dan paling berkeupayaan pada ketika itu.
Alibaba melancarkan Qwen2.5 Max pada 28–29 Januari 2025 sebagai model Qwen terbesar dan paling berkeupayaan pada ketika itu. Model campuran pakar (MoE) ini dilatih menggunakan lebih 20 trilion token, kemudian diperkemas melalui supervised fine tuning dan reinforcement learning daripada maklum balas manusia.
Alibaba mendakwa Qwen2.5 Max mengatasi GPT 4o, DeepSeek V3 dan Llama 3.1 405B dalam hampir semua penilaian, tetapi dakwaan itu perlu dibaca mengikut penanda aras dan dinisbahkan kepada syarikat tersebut.