Alibaba yhdistää Qwen3.8 Flashin, multimodaalisen pilvimallin, jonka hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta, sekä Flash Nextin, Qwen4 arkkitehtuurin avoimen paino... Flash Nextissä on 125 miljardin parametrin päämalli ja 51 miljardia N gram embedding parametria,...
JulkaisijaMuokattu mallilla GPT-5.6 LunaKuvat luotu mallilla GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba julkaisi kaksi läheisesti toisiinsa liittyvää mutta eri tarkoitukseen suunnattua mallia. Qwen3.8-Flash on tuotantokäyttöön tarkoitettu multimodaalinen malli, jota tarjotaan QwenCloud-palvelussa poikkeuksellisen edullisilla tokenhinnoilla. Qwen3.8-Flash-Next puolestaan on avoimilla painoilla julkaistu esiversio arkkitehtuurista, jonka Alibaba kertoo olevan suunniteltu tulevaa Qwen4-malliperhettä varten. 5
15
Strategia on selvä: halpa pilvipohjainen päättely houkuttelee yritysten työkuormia, kun taas avoimet painot rakentavat kehittäjien kiinnostusta, työkaluja ja ekosysteemiä Qwen4:n ympärille. Teknisiä väitteitä on paljon, mutta merkittävä osa suorituskyky- ja kustannusluvuista on peräisin Alibabalta tai sen omasta mallikortista, ei riippumattomista testeistä.
Alibaba kuvaa Qwen3.8-Flashia multimodaaliseksi mixture-of-experts- eli MoE-malliksi, joka on suunniteltu muun muassa ohjelmointiin, toimistotyöhön ja pitkän kontekstin tehtäviin. Yhtiön mukaan oletuskonteksti on 262 144 tokenia, ja sitä voidaan laajentaa miljoonaan tokeniin suuria tiedostoja, pitkiä keskusteluja ja tutkimustyötä varten. 5
15
QwenCloudin ilmoitettu hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta. Alibaba kertoi tuotanto-API:n tulevan saataville pian, ja myöhemmässä raportoinnissa QwenCloudin kuvattiin tarjoavan mallia näillä hinnoilla. 4
15
Hinnoittelu tekee Flashista enemmän kuin pelkän mallijulkaisun: se on myös infrastruktuurituote. Näillä hinnoilla kehittäjät voivat kokeilla dokumenttien käsittelyä, ohjelmointiautomaatteja ja suurivolyymisiä työnkulkuja ilman kaikkein kehittyneimpiin malleihin yleensä liittyvää hintalisää.
Flash-Next ei ole vain toinen API-taso. Se on avoimilla painoilla julkaistu malli, jonka tarkoitus on esitellä Qwen4:n arkkitehtuurin suuntaa. Mallirepositorion mukaan päämallissa on 125 miljardia parametria, lisäksi 51 miljardia parametria N-gram-embeddauksissa, ja kutakin tokenia kohden aktivoituu vain 6 miljardia parametria.
Kyseessä on harva mixture-of-experts-rakenne. Mallissa on suuri parametrien kokonaisjoukko, mutta jokaisen tokenin käsittelyssä käytetään vain pientä osaa siitä. Periaatteessa tämä voi pienentää tokenikohtaista laskentaa ja säilyttää samalla suuremman kapasiteetin kuin samankokoinen tiheä malli.
Mallikortissa ilmoitetaan alkuperäiseksi konteksti-ikkunaksi 262 144 tokenia, jota voidaan YaRN-menetelmällä laajentaa miljoonaan tokeniin. 13 Flash ja Flash-Next ovat kuitenkin eri julkaisuja, joten kehittäjien kannattaa tarkistaa suunnitellun version tarkat rajat, palvelukäyttäytyminen ja muistivaatimukset käyttödokumentaatiosta.
| Ominaisuus | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Päärooli | Tuotantokäyttöön tarkoitettu pilvimalli | Qwen4:n arkkitehtuurin avoin esiversio |
| Käyttö | Multimodaalinen ohjelmointi, toimistotyö ja agenttityönkulut | Multimodaalinen ohjelmointi, toimistotyö ja pitkäkestoiset agenttitehtävät |
| Konteksti | Oletuksena 262 144 tokenia, laajennettavissa miljoonaan | Natiivisti 262 144 tokenia, raportoidusti miljoonaan YaRNilla |
| Pilvihinta | 0,16 dollaria / miljoona syötetokenia; 0,47 dollaria / miljoona tulostokenia | Avoimille painoille ei ole vahvistettua Alibaba-API-hintaa |
| Arkkitehtuuri | Alibaba kuvaa Flash-sarjaa multimodaaliseksi MoE-malliksi | 125 miljardia päämallin parametria, 51 miljardia N-gram-embedding-parametria, 6 miljardia aktiivista parametria tokenia kohden |
| Saatavuus | QwenCloud-tuotanto-API ilmoitettu julkaistavaksi | Painot ja mallikortin tiedot ilmestyivät elokuun 2026 lopulla |
Ajoitus vahvistaa mallien välisen yhteyden. Flash-Nextin repositorio ja mallikortin tiedot tulivat saataville ennen tuotanto-API:n ilmoitusta tai sen yhteydessä. Kehittäjät saivat näin varhaisen katsauksen arkkitehtuuriin samalla kun Alibaba valmisteli hallinnoitua pilvipalvelua. 7
Alibaba kertoo uuden Flash-sarjan kouluttamisen maksaneen noin yhdeksäsosan Qwen3.7-Plussan koulutuskustannuksista samalla kun suorituskyky olisi parantunut erityisesti ohjelmoinnissa ja toimistotehtävissä. 5
15
Kyse on merkittävästä väitteestä, mutta sitä on syytä pitää yhtiön ilmoittamana vertailuna, ei riippumattomasti auditoituna kustannustutkimuksena. Koulutuskustannuksiin vaikuttavat esimerkiksi laitteistojen hinnat, koulutuksen kesto, datan valmistelu, epäonnistuneet ajot ja käytetty laskentatapa.
Harva arkkitehtuuri tarjoaa silti uskottavan teknisen perustan Alibaban painotukselle tehokkuudesta: vain osa käytettävissä olevista parametreista aktivoituu kunkin tokenin kohdalla. Ostajalle ero on käytännöllinen. Pilvimallin hinta on suoraan hyödynnettävissä API-budjetoinnissa, kun taas yhdeksäsosaan liittyvä luku kannattaa toistaiseksi nähdä arkkitehtuuria ja strategiaa kuvaavana signaalina.
Alibaban Flash-Next-mallikortissa ilmoitetaan seuraavat tulokset:
Mallikortin vertailutaulukossa Flash-Next saa listattua Claude Opus 4.6 Maxia paremman tuloksen SWE-bench Pro-, SWE-bench Multilingual-, CoWorkBench- ja JobBench-testeissä. Esimerkiksi SWE-bench Prossa ilmoitettu vertailu on 62,5 vastaan 53,4, ja monikielisessä SWE-benchissä 81,0 vastaan 77,5.
Tulokset viittaavat vahvaan suorituskykyyn ohjelmistokehityksessä ja työelämän agenttitehtävissä. Ne eivät kuitenkaan osoita, että Flash-Next olisi yleisesti Claudea tai muita huippumalleja parempi. Luvut ovat toimittajan julkaisemia, testausasetelmat voivat poiketa toisistaan, eikä Flash-Nextin tuloksia pidä automaattisesti tulkita jokaisen tuotannossa käytettävän Qwen3.8-Flash-version tuloksiksi.
Lähteissä Flash-Nextia kuvataan avoimilla painoilla julkaistuksi malliksi. Yhdessä malliyhteenvedossa lisenssiksi mainitaan qwen-community-1.0, mutta kehittäjien kannattaa tarkistaa voimassa oleva lisenssi virallisesta repositoriosta ja mallikortista ennen kaupallista uudelleenjakelua, hienosäätöä tai palveluna tarjoamista. 6
”Avoimet painot” eivät automaattisesti tarkoita, että kaikki käyttötavat olisivat rajoittamattomia. Lisenssi voi sisältää ehtoja esimerkiksi jakelusta, nimeämisestä, hyväksyttävästä käytöstä tai johdannaismalleista. Saatavilla oleva näyttö ei riitä laajempiin johtopäätöksiin kaikkien julkaisun komponenttien kaupallisista oikeuksista.
Mallijulkaisu osuu ajankohtaan, jolloin Alibaba kasvattaa voimakkaasti AI-infrastruktuuriin tehtäviä investointeja. Reutersin mukaan neljännesvuosittainen pilviliikevaihto kasvoi 45 prosenttia, pääomamenot 75 prosenttia ja neljännesvuosittainen nettotulos laski 75 prosenttia. 18
Reuters kertoi lisäksi, että Alibaba keräsi 10 miljardia dollaria Hongkongin osakeannilla rahoittaakseen AI-tavoitteitaan. Luvut kuvaavat strategian vaihtokauppaa: pilvi- ja laskentakysyntä kasvaa, mutta kapasiteetin rakentaminen painaa välittömästi tulosta ja kassavirtaa.
Halpa hinnoittelu voi siksi olla strategisesti järkevää, vaikka se rajoittaisi mallien lyhyen aikavälin katteita. Edullinen päättely voi nostaa Alibaban pilvi-infrastruktuurin käyttöastetta, houkutella yritysasiakkaita ja tehdä Qwenista varteenotettavan vaihtoehdon pitkän kontekstin sovellusten rakentajille.
Flash-Next laajentaa Alibaban vaikutuspiiriä sen oman API-palvelun ulkopuolelle. Kehittäjät voivat testata, muokata ja ajaa mallia itse, mikä synnyttää tuttavuutta Qwenin työkalujen ja arkkitehtuurin kanssa ilman välitöntä sitoutumista QwenCloudiin.
Tämä voi tukea Alibabaa monella tavalla:
Saatavilla oleva näyttö tukee tätä strategisena tulkintana, ei todisteena siitä, että Qwen olisi jo voittanut Kiinan kehittäjäekosysteemin. Lähteissä ei ole vahvistettua ajantasaista lukua aktiivisista kehittäjistä, latauksista tai yrityskäyttöönottojen määrästä.
Qwen3.8-Flash ja Flash-Next kannattaa nähdä saman tuotestrategian kahtena puolena. Flash on edullinen ja pitkän kontekstin pilvipalvelu, kun taas Flash-Next on Qwen4:ää pohjustava avoin ekosysteemi- ja arkkitehtuurihanke.
0,16 dollarin syötehinta, jopa miljoonan tokenin konteksti, paljon suuremman mallin läpi kulkeva raportoidusti 6 miljardin aktiivisen parametrin polku sekä vahvat toimittajan julkaisemat ohjelmointi- ja agenttivertailut tekevät julkaisusta kiinnostavan kehittäjille, jotka seuraavat päättelyn kustannuksia. 4
Varaukset ovat silti tärkeitä. Tuotantomallia ja esiversiota ei pidä sekoittaa toisiinsa, koulutuskustannusväitettä ei ole riippumattomasti auditoitu, vertailutulokset ovat toimittajan raportoimia eikä käyttöönottojen laajuutta voida näillä lähteillä mitata.
Alibaba näyttäytyy vakavana ja hyvin rahoitettuna kilpailijana Kiinan AI-kilpailussa – ei kiistattomana johtajana. Yhtiön halukkuus käyttää runsaasti rahaa kertoo, että Qwenia käsitellään pitkän aikavälin pilvi- ja ekosysteemipanostuksena, ei lyhyen aikavälin voitontuottajana. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba yhdistää Qwen3.8 Flashin, multimodaalisen pilvimallin, jonka hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta, sekä Flash Nextin, Qwen4 arkkitehtuurin avoimen paino...
Alibaba yhdistää Qwen3.8 Flashin, multimodaalisen pilvimallin, jonka hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta, sekä Flash Nextin, Qwen4 arkkitehtuurin avoimen paino... Flash Nextissä on 125 miljardin parametrin päämalli ja 51 miljardia N gram embedding parametria, mutta vain 6 miljardia parametria aktivoituu tokenia kohden.
Julkaisu sopii Alibaban laajempaan AI strategiaan: pilviliikevaihto kasvoi 45 prosenttia, mutta pääomamenot nousivat 75 prosenttia ja neljännesvuosittainen nettotulos laski 75 prosenttia.
Alibaba yhdistää Qwen3.8 Flashin, multimodaalisen pilvimallin, jonka hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta, sekä Flash Nextin, Qwen4 arkkitehtuurin avoimen paino... Flash Nextissä on 125 miljardin parametrin päämalli ja 51 miljardia N gram embedding parametria,...
JulkaisijaMuokattu mallilla GPT-5.6 LunaKuvat luotu mallilla GPT Image 1.5
Research answer

Create a landscape editorial hero image for this Studio Global article: What did Alibaba announce with the release of the multimodal Qwen3.8-Flash and the open-weight Qwen3.8-Flash-Next prototype for its future Q. Article summary: Alibaba is pairing a low-cost production model with an open-weight architectural preview: it is trying to make Qwen a widely deployed cloud service while seeding the developer ecosystem for the forthcoming Qwen4 generati. Topic tags: general, documentation, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, water
Alibaba julkaisi kaksi läheisesti toisiinsa liittyvää mutta eri tarkoitukseen suunnattua mallia. Qwen3.8-Flash on tuotantokäyttöön tarkoitettu multimodaalinen malli, jota tarjotaan QwenCloud-palvelussa poikkeuksellisen edullisilla tokenhinnoilla. Qwen3.8-Flash-Next puolestaan on avoimilla painoilla julkaistu esiversio arkkitehtuurista, jonka Alibaba kertoo olevan suunniteltu tulevaa Qwen4-malliperhettä varten. 5
15
Strategia on selvä: halpa pilvipohjainen päättely houkuttelee yritysten työkuormia, kun taas avoimet painot rakentavat kehittäjien kiinnostusta, työkaluja ja ekosysteemiä Qwen4:n ympärille. Teknisiä väitteitä on paljon, mutta merkittävä osa suorituskyky- ja kustannusluvuista on peräisin Alibabalta tai sen omasta mallikortista, ei riippumattomista testeistä.
Alibaba kuvaa Qwen3.8-Flashia multimodaaliseksi mixture-of-experts- eli MoE-malliksi, joka on suunniteltu muun muassa ohjelmointiin, toimistotyöhön ja pitkän kontekstin tehtäviin. Yhtiön mukaan oletuskonteksti on 262 144 tokenia, ja sitä voidaan laajentaa miljoonaan tokeniin suuria tiedostoja, pitkiä keskusteluja ja tutkimustyötä varten. 5
15
QwenCloudin ilmoitettu hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta. Alibaba kertoi tuotanto-API:n tulevan saataville pian, ja myöhemmässä raportoinnissa QwenCloudin kuvattiin tarjoavan mallia näillä hinnoilla. 4
15
Hinnoittelu tekee Flashista enemmän kuin pelkän mallijulkaisun: se on myös infrastruktuurituote. Näillä hinnoilla kehittäjät voivat kokeilla dokumenttien käsittelyä, ohjelmointiautomaatteja ja suurivolyymisiä työnkulkuja ilman kaikkein kehittyneimpiin malleihin yleensä liittyvää hintalisää.
Flash-Next ei ole vain toinen API-taso. Se on avoimilla painoilla julkaistu malli, jonka tarkoitus on esitellä Qwen4:n arkkitehtuurin suuntaa. Mallirepositorion mukaan päämallissa on 125 miljardia parametria, lisäksi 51 miljardia parametria N-gram-embeddauksissa, ja kutakin tokenia kohden aktivoituu vain 6 miljardia parametria.
Kyseessä on harva mixture-of-experts-rakenne. Mallissa on suuri parametrien kokonaisjoukko, mutta jokaisen tokenin käsittelyssä käytetään vain pientä osaa siitä. Periaatteessa tämä voi pienentää tokenikohtaista laskentaa ja säilyttää samalla suuremman kapasiteetin kuin samankokoinen tiheä malli.
Mallikortissa ilmoitetaan alkuperäiseksi konteksti-ikkunaksi 262 144 tokenia, jota voidaan YaRN-menetelmällä laajentaa miljoonaan tokeniin. 13 Flash ja Flash-Next ovat kuitenkin eri julkaisuja, joten kehittäjien kannattaa tarkistaa suunnitellun version tarkat rajat, palvelukäyttäytyminen ja muistivaatimukset käyttödokumentaatiosta.
| Ominaisuus | Qwen3.8-Flash | Qwen3.8-Flash-Next |
|---|---|---|
| Päärooli | Tuotantokäyttöön tarkoitettu pilvimalli | Qwen4:n arkkitehtuurin avoin esiversio |
| Käyttö | Multimodaalinen ohjelmointi, toimistotyö ja agenttityönkulut | Multimodaalinen ohjelmointi, toimistotyö ja pitkäkestoiset agenttitehtävät |
| Konteksti | Oletuksena 262 144 tokenia, laajennettavissa miljoonaan | Natiivisti 262 144 tokenia, raportoidusti miljoonaan YaRNilla |
| Pilvihinta | 0,16 dollaria / miljoona syötetokenia; 0,47 dollaria / miljoona tulostokenia | Avoimille painoille ei ole vahvistettua Alibaba-API-hintaa |
| Arkkitehtuuri | Alibaba kuvaa Flash-sarjaa multimodaaliseksi MoE-malliksi | 125 miljardia päämallin parametria, 51 miljardia N-gram-embedding-parametria, 6 miljardia aktiivista parametria tokenia kohden |
| Saatavuus | QwenCloud-tuotanto-API ilmoitettu julkaistavaksi | Painot ja mallikortin tiedot ilmestyivät elokuun 2026 lopulla |
Ajoitus vahvistaa mallien välisen yhteyden. Flash-Nextin repositorio ja mallikortin tiedot tulivat saataville ennen tuotanto-API:n ilmoitusta tai sen yhteydessä. Kehittäjät saivat näin varhaisen katsauksen arkkitehtuuriin samalla kun Alibaba valmisteli hallinnoitua pilvipalvelua. 7
Alibaba kertoo uuden Flash-sarjan kouluttamisen maksaneen noin yhdeksäsosan Qwen3.7-Plussan koulutuskustannuksista samalla kun suorituskyky olisi parantunut erityisesti ohjelmoinnissa ja toimistotehtävissä. 5
15
Kyse on merkittävästä väitteestä, mutta sitä on syytä pitää yhtiön ilmoittamana vertailuna, ei riippumattomasti auditoituna kustannustutkimuksena. Koulutuskustannuksiin vaikuttavat esimerkiksi laitteistojen hinnat, koulutuksen kesto, datan valmistelu, epäonnistuneet ajot ja käytetty laskentatapa.
Harva arkkitehtuuri tarjoaa silti uskottavan teknisen perustan Alibaban painotukselle tehokkuudesta: vain osa käytettävissä olevista parametreista aktivoituu kunkin tokenin kohdalla. Ostajalle ero on käytännöllinen. Pilvimallin hinta on suoraan hyödynnettävissä API-budjetoinnissa, kun taas yhdeksäsosaan liittyvä luku kannattaa toistaiseksi nähdä arkkitehtuuria ja strategiaa kuvaavana signaalina.
Alibaban Flash-Next-mallikortissa ilmoitetaan seuraavat tulokset:
Mallikortin vertailutaulukossa Flash-Next saa listattua Claude Opus 4.6 Maxia paremman tuloksen SWE-bench Pro-, SWE-bench Multilingual-, CoWorkBench- ja JobBench-testeissä. Esimerkiksi SWE-bench Prossa ilmoitettu vertailu on 62,5 vastaan 53,4, ja monikielisessä SWE-benchissä 81,0 vastaan 77,5.
Tulokset viittaavat vahvaan suorituskykyyn ohjelmistokehityksessä ja työelämän agenttitehtävissä. Ne eivät kuitenkaan osoita, että Flash-Next olisi yleisesti Claudea tai muita huippumalleja parempi. Luvut ovat toimittajan julkaisemia, testausasetelmat voivat poiketa toisistaan, eikä Flash-Nextin tuloksia pidä automaattisesti tulkita jokaisen tuotannossa käytettävän Qwen3.8-Flash-version tuloksiksi.
Lähteissä Flash-Nextia kuvataan avoimilla painoilla julkaistuksi malliksi. Yhdessä malliyhteenvedossa lisenssiksi mainitaan qwen-community-1.0, mutta kehittäjien kannattaa tarkistaa voimassa oleva lisenssi virallisesta repositoriosta ja mallikortista ennen kaupallista uudelleenjakelua, hienosäätöä tai palveluna tarjoamista. 6
”Avoimet painot” eivät automaattisesti tarkoita, että kaikki käyttötavat olisivat rajoittamattomia. Lisenssi voi sisältää ehtoja esimerkiksi jakelusta, nimeämisestä, hyväksyttävästä käytöstä tai johdannaismalleista. Saatavilla oleva näyttö ei riitä laajempiin johtopäätöksiin kaikkien julkaisun komponenttien kaupallisista oikeuksista.
Mallijulkaisu osuu ajankohtaan, jolloin Alibaba kasvattaa voimakkaasti AI-infrastruktuuriin tehtäviä investointeja. Reutersin mukaan neljännesvuosittainen pilviliikevaihto kasvoi 45 prosenttia, pääomamenot 75 prosenttia ja neljännesvuosittainen nettotulos laski 75 prosenttia. 18
Reuters kertoi lisäksi, että Alibaba keräsi 10 miljardia dollaria Hongkongin osakeannilla rahoittaakseen AI-tavoitteitaan. Luvut kuvaavat strategian vaihtokauppaa: pilvi- ja laskentakysyntä kasvaa, mutta kapasiteetin rakentaminen painaa välittömästi tulosta ja kassavirtaa.
Halpa hinnoittelu voi siksi olla strategisesti järkevää, vaikka se rajoittaisi mallien lyhyen aikavälin katteita. Edullinen päättely voi nostaa Alibaban pilvi-infrastruktuurin käyttöastetta, houkutella yritysasiakkaita ja tehdä Qwenista varteenotettavan vaihtoehdon pitkän kontekstin sovellusten rakentajille.
Flash-Next laajentaa Alibaban vaikutuspiiriä sen oman API-palvelun ulkopuolelle. Kehittäjät voivat testata, muokata ja ajaa mallia itse, mikä synnyttää tuttavuutta Qwenin työkalujen ja arkkitehtuurin kanssa ilman välitöntä sitoutumista QwenCloudiin.
Tämä voi tukea Alibabaa monella tavalla:
Saatavilla oleva näyttö tukee tätä strategisena tulkintana, ei todisteena siitä, että Qwen olisi jo voittanut Kiinan kehittäjäekosysteemin. Lähteissä ei ole vahvistettua ajantasaista lukua aktiivisista kehittäjistä, latauksista tai yrityskäyttöönottojen määrästä.
Qwen3.8-Flash ja Flash-Next kannattaa nähdä saman tuotestrategian kahtena puolena. Flash on edullinen ja pitkän kontekstin pilvipalvelu, kun taas Flash-Next on Qwen4:ää pohjustava avoin ekosysteemi- ja arkkitehtuurihanke.
0,16 dollarin syötehinta, jopa miljoonan tokenin konteksti, paljon suuremman mallin läpi kulkeva raportoidusti 6 miljardin aktiivisen parametrin polku sekä vahvat toimittajan julkaisemat ohjelmointi- ja agenttivertailut tekevät julkaisusta kiinnostavan kehittäjille, jotka seuraavat päättelyn kustannuksia. 4
Varaukset ovat silti tärkeitä. Tuotantomallia ja esiversiota ei pidä sekoittaa toisiinsa, koulutuskustannusväitettä ei ole riippumattomasti auditoitu, vertailutulokset ovat toimittajan raportoimia eikä käyttöönottojen laajuutta voida näillä lähteillä mitata.
Alibaba näyttäytyy vakavana ja hyvin rahoitettuna kilpailijana Kiinan AI-kilpailussa – ei kiistattomana johtajana. Yhtiön halukkuus käyttää runsaasti rahaa kertoo, että Qwenia käsitellään pitkän aikavälin pilvi- ja ekosysteemipanostuksena, ei lyhyen aikavälin voitontuottajana. 18
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
Alibaba yhdistää Qwen3.8 Flashin, multimodaalisen pilvimallin, jonka hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta, sekä Flash Nextin, Qwen4 arkkitehtuurin avoimen paino...
Alibaba yhdistää Qwen3.8 Flashin, multimodaalisen pilvimallin, jonka hinta on 0,16 dollaria miljoonalta syötetokenilta ja 0,47 dollaria miljoonalta tulostokenilta, sekä Flash Nextin, Qwen4 arkkitehtuurin avoimen paino... Flash Nextissä on 125 miljardin parametrin päämalli ja 51 miljardia N gram embedding parametria, mutta vain 6 miljardia parametria aktivoituu tokenia kohden.
Julkaisu sopii Alibaban laajempaan AI strategiaan: pilviliikevaihto kasvoi 45 prosenttia, mutta pääomamenot nousivat 75 prosenttia ja neljännesvuosittainen nettotulos laski 75 prosenttia.