Twee Wall Street-banken namen het tegenovergestelde standpunt in. Citi en Bank of America Securities betoogden allebei dat de verkoopgolf precies de verkeerde gok was, en ze haalden een 160 jaar oude economische theorie aan om uit te leggen waarom: de Jevons Paradox.
Citi en Bank of America Securities stellen allebei dat Kimi K3's efficiëntiedoorbraak de totale vraag naar geheugenchips zal doen toenemen in plaats van afnemen, omdat het verlagen van de kosten per token AI drastisch toegankelijker en breder inzetbaar maakt — een schoolvoorbeeld van de Jevons Paradox. De selloff van 16 juli was volgens hen de verkeerde richting .
Citi-halfgeleideranalist Peter Lee verwijst expliciet naar de Jevons Paradox: verbeterde technologische efficiëntie verlaagt de kosten per eenheid, wat historisch leidt tot een toename — niet een afname — van het totale verbruik . In een Citi Research-podcast die maanden voor K3's lancering werd opgenomen, stelde Lee: "Ik denk dat dit soort software-efficiëntie geen bedreiging is voor geheugen. Ik denk dat het positief is voor de vraag omdat het AI goedkoper en nuttiger maakt, wat een inkoopcyclus van nog hogere vraag naar de geavanceerde chips aandrijft. Dus ik denk dat het de Jevons paradox is" .
Zijn redenatie waarom Kimi K3's architectuur specifiek meer geheugenvraag aandrijft:
Citi heeft ook afzonderlijk de geheugenprijsverwachtingen fors verhoogd, met een voorspelling dat DRAM-prijzen in 2026 tot 200% zouden kunnen stijgen en HBM-prijzen in Q4 2026 met 30% kwartaal-op-kwartaal, wat aangeeft dat ze al vóór Kimi K3 een door AI gedreven geheugensupercyclus verwachtten . Citi waarschuwde al in september 2025 dat zowel DRAM als NAND-flashgeheugen in 2026 in een tekort zouden komen .
Bank of America heeft de term "Jevons Paradox" niet expliciet gebruikt in gepubliceerd commentaar over Kimi K3, maar hun al bestaande en na-de-selloff oproepen sluiten aan bij dezelfde logica:
| Architectonisch kenmerk | Waarom het de geheugenvraag stimuleert |
|---|---|
| 2,8T totale parameters (MoE) | Zelfs met sparse activatie moeten 2,8T-gewichten in het systeemgeheugen verblijven. Open-weight zelfhosting vereist servers met grote DDR5-pools en HBM-uitgeruste GPU's . |
| 1M-token contextvenster | De KV-cache schaalt lineair met de contextlengte. Goedkopere inferentie stimuleert langere prompts, wat het geheugengebruik per query verhoogt . |
| Agentische / meerstaps workflows | Elke redeneerstap is een aparte inferentieaanroep. Meer stappen per taak = meer geheugenbandbreedte gebruikt per gebruikerssessie . |
| Open-weight release (27 juli) | Maakt wijdverspreide zelfhosting mogelijk. Elke zelfgehoste implementatie voegt een vaste geheugenvoetafdruk toe die een gedeeld API-eindpunt zou hebben geconsolideerd . |
| Concurrerende prijzen (~$3/M tokens input) | Historisch gezien vermenigvuldigde elke grote AI-prijsdaling het totale tokenvolume, wat de efficiëntiewinst verre overtrof . |
De DeepSeek-R1-selloff in januari 2025 volgde hetzelfde patroon: een goedkoper, efficiënt Chinees model veroorzaakte een halfgeleiderpaniek, waarna de chipvraag juist versnelde naarmate de inzet verbreedde . Citi en BofA zien Kimi K3 als "DeepSeek 2.0" — dezelfde angst, en waarschijnlijk dezelfde uiteindelijke uitkomst voor geheugenmakers als Samsung, SK Hynix en Micron .
Industriegegevens ondersteunen de these. TrendForce voorspelde dat de HBM-vraag in 2026 alleen al met 70% jaar-op-jaar zou toenemen, waarbij HBM 23% van de totale DRAM-waferproductie zou opslokken . Analisten schatten dat AI-datacenters in 2026 ~70% van de high-end DRAM zouden kunnen verbruiken . Geheugenfabrikanten zelf — waaronder Micron-CEO Sanjay Mehrotra — hebben toegegeven dat tekorten tot na 2026 zullen aanhouden .
Zelfs de Koreaanse markt herkende het argument: op 20 juli meldde de Chosun Ilbo dat een memo uit de effectenindustrie waarin de Jevons Paradox werd aangehaald, de aandelen van Samsung en SK Hynix kortstondig positief deed omkeren voordat de bredere selloff werd hervat .
Het is belangrijk om de grenzen van deze these te noteren. Geen van beide banken beweert dat de selloff irrationeel was — alleen dat hij in de verkeerde richting ging. BofA erkende expliciet dat legitieme "kosteninflatie-angsten in geheugen" mede de daling veroorzaakten . Citi's geheugenprijsvoorspellingen, hoewel bullish, impliceren ook prijsdruk die stroomafwaartse AI-bedrijven zou kunnen knellen. En Bank of America heeft de term "Jevons Paradox" niet expliciet gebruikt in gepubliceerd Kimi K3-commentaar; de afstemming van hun logica is afgeleid uit hun al bestaande en na-de-selloff oproepen .
Beide banken erkennen de kortetermijnangst van de markt, maar hun consistente standpunt is dat Kimi K3's lagere kosten en open-weight release de AI-adoptie zullen verbreden, het totale inferentievolume zullen verhogen en de geheugenvraag zullen doen stijgen — niet doen stranden. De Jevons Paradox, voor het eerst waargenomen in 19e-eeuws kolenverbruik, zou wel eens het meest betrouwbare raamwerk kunnen blijken om de halfgeleidervraag van AI in 2026 te begrijpen.