DeepSeekin V4 Flash ja V4 Pro mallien API hinnat nousevat mallista, token tyypistä ja käyttöajasta riippuen 50 prosentista yli 1 100 prosenttiin. Uusi hinnoittelu jakaa vuorokauden ruuhka ja hiljaisiin aikoihin.
Research answer

Create a landscape editorial hero image for this Studio Global article: How are DeepSeek’s August 2026 API price increases for V4-Flash and V4-Pro—including peak/off-peak rates, increases of 50% to more than 1,10. Article summary: DeepSeek is moving from a land-grab API strategy toward yield management and monetization, while OpenAI is using free consumer access to defend distribution and habit. They are not directly equivalent offers—developer AP. Topic tags: general, general web, user generated, news. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts w
DeepSeekin elokuussa 2026 tekemä API-hinnoittelun uudistus ja OpenAI:n ilmaisen ChatGPT:n laajennus ovat kaksi erilaista vastausta samaan tekoälyalan talousongelmaan: miten houkutella valtavasti käyttöä, kun mallien ajaminen eli inferenssi käy jatkuvasti kalliimmaksi.
DeepSeek luopuu erittäin halpaan ja tasaiseen hinnoitteluun perustuneesta strategiasta. OpenAI puolestaan käyttää laajaa ilmaista käyttöä vahvistaakseen kuluttajajakelua. Kyse ei ole suorista verrokeista – toinen koskee kehittäjille suunnattua infrastruktuuria ja toinen kuluttajille tarkoitettua chat-palvelua – mutta yhdessä muutokset kertovat kilpailun siirtyvän pois pelkästä halvimmasta token-hinnasta.
Ratkaiseviksi tekijöiksi nousevat nyt saatavuus, käyttäjien tottumukset, liikenteen reititys ja liiketoiminnan kestävyys.
DeepSeekin uusi hinnoittelu tuli voimaan 16. elokuuta 2026 kello 16.00 UTC. Yhtiö otti V4-Flash- ja V4-Pro-malleissa käyttöön erilliset ruuhka- ja hiljaisten aikojen hinnat. Hiljaisten aikojen hinnat ovat puolet ruuhka-aikojen hinnoista. Ruuhka-ajat ovat 01.00–04.00 ja 06.00–10.00 UTC; kaikki muut ajat ovat hiljaisia.
| Malli | Aika | Välimuistiosuma, syöte | Ei välimuistiosumaa, syöte | Tuloste |
|---|---|---|---|---|
| V4-Flash | Hiljainen aika | 0,007 $ | 0,22 $ | 0,66 $ |
| V4-Flash | Ruuhka-aika | 0,014 $ | 0,44 $ | 1,32 $ |
| V4-Pro | Hiljainen aika | 0,022 $ | 0,66 $ | 1,98 $ |
| V4-Pro | Ruuhka-aika | 0,044 $ | 1,32 $ | 3,96 $ |
Hinnat ovat Yhdysvaltain dollareita miljoonaa tokenia kohti. Välimuistiosuma ja sen puuttuminen koskevat syötetokeneita.
”Hiljainen aika” ei tässä tarkoita, että hinta olisi aina aiempaa halvempi. Uusi V4-Flashin tulosteen hinta, 0,66 dollaria miljoonaa tokenia kohti, on jo yli kaksinkertainen aiempaan 0,28 dollarin hintaan verrattuna. V4-Pron tulosteen hinta nousee puolestaan aiemmasta 0,87 dollarin tarjoushinnasta 1,98 dollariin hiljaisena aikana.
Korotus vaihtelee mallin, token-tyypin ja käyttöajan mukaan. Reutersin mukaan uudet hinnat ovat 50–1 100 prosenttia aiempia korkeammat.
Suurimmat prosentuaaliset muutokset koskevat välimuistiosumien hintoja, jotka lähtivät alun perin erittäin matalalta tasolta. Kehittäjän todellinen kustannus riippuu enemmän käyttöprofiilista: kuinka paljon syntyy syötettä ja tulostetta, kuinka suuri osuus syötteestä osuu välimuistiin ja kuinka paljon liikennettä osuu ruuhkatunneille.
Esimerkiksi V4-Pron tuloste maksaa hiljaisena aikana noin 128 prosenttia enemmän kuin aiempi 0,87 dollarin tarjoushinta. Ruuhka-aikana hinta on noin 355 prosenttia korkeampi.
DeepSeek on silti korotusten jälkeenkin edullinen verrattuna moniin suljettuihin yhdysvaltalaisiin malleihin. Aiemmissa tiedoissa V4-Pron tulosteen tarjoushinnaksi ilmoitettiin noin 0,87 dollaria miljoonaa tokenia kohti, kun johtavien yhdysvaltalaisten järjestelmien historialliset hinnat ovat olleet selvästi korkeampia. Hinnankorotus siis heikentää DeepSeekin kustannusetua, mutta ei poista sitä.
Jos kehittäjän sovellus tuottaa kuukaudessa 10 miljoonaa V4-Pro-tulostokenia, laskelma on seuraava:
Pelkkien tulostokenien kustannus kasvaa näin noin 11,10–30,90 dollaria kuukaudessa käyttöajasta riippuen. Laskelma ei sisällä syötetokeneita, välimuistiosumien maksuja, veroja tai muita alustamaksuja.
Tuotantokäytössä suurempi merkitys voi olla koko liikenteen rakenteella, ei pelkillä tulosteilla. Pitkät syötteet, vähäinen välimuistin hyödyntäminen tai ruuhkatunneille painottuva liikenne voivat muuttaa loppulaskua huomattavasti. Eräajojen siirtäminen hiljaisiin aikaikkunoihin ja välimuistiosumien seuraaminen korostuvat uuden hinnoittelun myötä.
OpenAI ilmoitti ChatGPT-palveluun vastakkaissuuntaisesta muutoksesta. GPT-5.6 Luna tulee Free- ja Go-käyttäjien oletusmalliksi, ja yhtiö ilmoitti samalla rajattomista tekstikeskusteluista sekä uudesta Think-painikkeesta vaikeampia kysymyksiä varten.
Otsikko kaipaa kuitenkin täsmennystä: rajattomuus koskee tekstikeskusteluja, ei kaikkia ChatGPT:n ominaisuuksia. Tiedostojen lataamiseen, kuviin, puheeseen, kuvien luomiseen ja muihin työkaluihin jää rajoituksia. Lisäksi tarjontaan sovelletaan väärinkäytösten vastaisia suojamekanismeja.
Kyse on kuluttajajakelun strategiasta, ei API-hinnoittelusta. OpenAI madaltaa arkisen käytön kynnystä ja pitää kyvykkään mallin ChatGPT:n oletuskokemuksessa. TechCrunchin mukaan ChatGPT:llä oli ilmoituksen aikaan jo yli miljardi viikoittaista käyttäjää.
Halvat token-hinnat auttoivat kiinalaisia malleja saavuttamaan kehittäjiä. Vercelin AI Gateway -palvelusta kerätty mittari osoitti, että kiinalaisperäiset avoimien painojen mallit käsittelivät kesäkuussa 2026 29 prosenttia tuotantotokeneista. Huhtikuussa osuus oli noin yhdeksäsosa. Samalla mallit vastasivat alle neljästä prosentista kulutuksesta. Luku koskee kyseisen yhdyskäytävän liikennettä, ei koko maailman tekoälymarkkinaa.
Ero on tärkeä. Tokeniosuus kertoo, kuinka paljon työtä järjestelmän kautta kulkee, mutta se ei yksin osoita liikevaihtoa, voittoa, asiakasuskollisuutta tai pysyvää markkinavoimaa. Kehittäjät voivat reitittää työkuormia palveluntarjoajalta toiselle, ja hintaherkkä liikenne voi siirtyä nopeasti hintojen muuttuessa.
Uusi aikaperusteinen hinnoittelu viittaa siihen, ettei käyttömäärän kasvattaminen ole enää ainoa tavoite. Sen avulla DeepSeek voi kohdentaa kapasiteettia ruuhka-aikoina ja veloittaa enemmän silloin, kun kysyntä keskittyy. Yhtiön virallinen dokumentaatio kuvaa muutosta resurssien kohdentamisen keinoksi ja kannustaa ajoittamaan tehtävät todellisen käytön mukaan.
Muutos ajoittuu aikaan, jolloin muutkin kiinalaiset tekoäly-yhtiöt tuovat maksullisia tarjouksia markkinoille tai harkitsevat hintojen nostamista. Kiinan laajempaa markkinaa koskevissa raporteissa Moonshot AI:n ja ByteDancen kerrotaan ottaneen käyttöön maksullisia paketteja ja Alibaban valmistautuvan seuraamaan perässä. Tämä viittaa alan laajempaan siirtymään aggressiivisista tuista kohti kaupallistamista.
Se ei todista, että DeepSeek tai sen kilpailijat olisivat voitollisia. Se kuitenkin osoittaa, että halvoilla hinnoilla hankittu markkinaosuus on jossain vaiheessa muutettava tokenikohtaiseksi liikevaihdoksi, toistuviksi sopimuksiksi tai muuksi kestäväksi liiketoiminnaksi.
OpenAI:n ilmainen Luna-julkaisu korostaa jakelua eikä mahdollisimman halpaa API-laskua. Tarjoamalla tekstikeskustelut laajasti ja tuomalla Think-painikkeen näkyvästi käyttöliittymään OpenAI pyrkii tekemään ChatGPT:stä pysyvän kuluttajatottumuksen. Kalliimpien ominaisuuksien rajat säilyvät samalla tiukempina.
Strateginen ero on selvä:
Strategiat voivat elää rinnakkain. Kehittäjä voi valita DeepSeekin suuren volyymin työkuormiin, kun taas yksittäinen käyttäjä käyttää ChatGPT:tä yleiseen avustamiseen. Molemmat yritykset pyrkivät kuitenkin tekemään ekosysteemistään vaikeammin korvattavan: DeepSeek kustannustehokkuuden ja liikenteen reitityksen avulla, OpenAI tuotetottumuksen ja kuluttajamäärän avulla.
DeepSeek on edelleen edullinen vaihtoehto, mutta kuvaus ”halvin malli” ei enää riitä. Kehittäjän kannattaa verrata koko laskua seuraavien tekijöiden perusteella:
Kiinan ja Yhdysvaltojen välinen tekoälykilpailu ei ole enää ensisijaisesti kilpailua siitä, kuka tarjoaa halvimman listahinnan.
DeepSeek testaa, pystyykö kiinalainen laboratorio muuttamaan kustannustehokkuuteen perustuvan johtoasemansa kestäväksi yksikkötaloudeksi. OpenAI puolestaan testaa, voiko ilmainen ja toistuva kuluttajakäyttö synnyttää pitkäkestoista ekosysteemin hallintaa.
Molempien haaste on lopulta sama: valtava käyttö on muutettava liiketoiminnaksi, joka pystyy rahoittamaan huippumallien jatkuvasti kalliin laskentakapasiteetin.
Studio Global AI
This page includes a source-backed answer you can continue inside Studio Global.
DeepSeekin V4 Flash ja V4 Pro mallien API hinnat nousevat mallista, token tyypistä ja käyttöajasta riippuen 50 prosentista yli 1 100 prosenttiin.
DeepSeekin V4 Flash ja V4 Pro mallien API hinnat nousevat mallista, token tyypistä ja käyttöajasta riippuen 50 prosentista yli 1 100 prosenttiin. Uusi hinnoittelu jakaa vuorokauden ruuhka ja hiljaisiin aikoihin. Ruuhkatunnit ovat klo 01–04 ja 06–10 UTC, ja niiden hinnat ovat kaksinkertaiset hiljaisiin tunteihin verrattuna.
Kymmenen miljoonan V4 Pro tulostokenin kuukausittainen kustannus nousee aiemmasta 8,70 dollarista 19,80 dollariin hiljaisena aikana tai 39,60 dollariin ruuhka aikana.