Googles omstreden switch naar compute-gebaseerde Gemini-limieten: wat er veranderde en waarom gebruikers terugduwden
In mei 2026 verving Google de eenvoudige dagelijkse promptlimieten van Gemini door compute quota die elke vijf uur worden ververst en rekening houden met de complexiteit van de prompt, de gebruikte functies en de leng... Het nieuwe systeem geldt zowel voor gratis als betalende abonnementen; hogere abonnementen krijg...
Gepubliceerd doorBewerkt met GPT-5.5Afbeeldingen gegenereerd met GPT Image 2
In mei 2026 verving Google de eenvoudige dagelijkse promptlimieten van Gemini door compute quota die elke vijf uur worden ververst en rekening houden met de complexiteit van de prompt, de gebruikte functies en de leng...
Het nieuwe systeem geldt zowel voor gratis als betalende abonnementen; hogere abonnementen krijgen een groter compute budget, waardoor de waarde van een abonnement steeds meer wordt bepaald door de beschikbare rekenkr...
Na felle kritiek van ontwikkelaars en zware gebruikers verhoogde Google in allerijl de limieten: de Gemini limieten in de codeeromgeving Antigravity werden verdrievoudigd en de wekelijkse quota werden gereset.[10][14]
How did Google’s new compute‑based usage limits for the Gemini AI assistant—introduced around Google I/O 2026 to replace daily prompt countsGemini’s new usage model measures compute consumption rather than simple prompt counts, reflecting the real cost of modern AI workloads.
AI Prompt
Create a landscape editorial hero image for this Studio Global article: How did Google’s new compute‑based usage limits for the Gemini AI assistant—introduced around Google I/O 2026 to replace daily prompt counts. Article summary: Google replaced Gemini’s old daily prompt-count system with compute-based quotas that refresh every five hours until a weekly cap is reached, and usage now depends on prompt complexity, features/models used, and chat len. Topic tags: general, general web. Reference image context from search candidates: Reference image 1: visual subject "Google is changing how it calculates your weekly Gemini usage limits, and it’s another reflection of how powerful agentic AI features have broken flat-rate consumer AI plans. As of" source context "Google just made big changes to Gemini usage limits - PCWorld" Reference image 2: visual subject "Google is changing how it calculat
openai.com
In mei 2026 veranderde Google fundamenteel hoe het zijn AI-assistent Gemini meet. In plaats van gebruikers te beperken door het aantal prompts per dag, gebruikt Gemini nu compute-quota die schatten hoeveel rekenkracht elke interactie kost. De wijziging was bedoeld om de werkelijke kosten van het draaien van moderne AI-modellen te weerspiegelen – maar leidde meteen tot felle kritiek van gebruikers die opeens veel sneller dan verwacht tegen hun limieten aanliepen.
De verschuiving van promptlimieten naar compute-budgetten
Voor de wijziging werd het gebruik van Gemini grotendeels bepaald door eenvoudige promptlimieten: gebruikers konden een vast aantal verzoeken per dag versturen. Dat systeem was eenvoudig te begrijpen, maar steeds minder passend bij hoe moderne AI-workloads zich gedragen.
Studio Global AI
Continue your research
This page includes a source-backed answer you can continue inside Studio Global.
What is the short answer to "Googles omstreden switch naar compute-gebaseerde Gemini-limieten: wat er veranderde en waarom gebruikers terugduwden"?
In mei 2026 verving Google de eenvoudige dagelijkse promptlimieten van Gemini door compute quota die elke vijf uur worden ververst en rekening houden met de complexiteit van de prompt, de gebruikte functies en de leng...
What are the key points to validate first?
In mei 2026 verving Google de eenvoudige dagelijkse promptlimieten van Gemini door compute quota die elke vijf uur worden ververst en rekening houden met de complexiteit van de prompt, de gebruikte functies en de leng... Het nieuwe systeem geldt zowel voor gratis als betalende abonnementen; hogere abonnementen krijgen een groter compute budget, waardoor de waarde van een abonnement steeds meer wordt bepaald door de beschikbare rekenkr...
What should I do next in practice?
Na felle kritiek van ontwikkelaars en zware gebruikers verhoogde Google in allerijl de limieten: de Gemini limieten in de codeeromgeving Antigravity werden verdrievoudigd en de wekelijkse quota werden gereset.[10][14]
Vanaf 17 mei 2026 verving Google die limieten door een systeem dat compute-verbruik bijhoudt in plaats van het aantal berichten.
In het nieuwe model hangt het gebruik af van verschillende factoren:
De complexiteit van de prompt
De gebruikte modellen of functies (zoals geavanceerd redeneren of media genereren)
De lengte van het gesprek
In plaats van dagelijkse resets, worden quota nu elke vijf uur ververst totdat een wekelijkse limiet wordt bereikt.
Dit betekent dat een korte tekstuele vraag weinig quota verbruikt, terwijl een lang gesprek met geavanceerde tools of codeerhulp het budget snel kan uitputten. Volgens Google geeft deze aanpak beter weer dat sommige AI-taken veel meer rekenkracht vereisen dan andere.
Hoe de nieuwe limieten gratis en betaalde abonnementen beïnvloeden
Het compute-gebaseerde systeem geldt voor alle abonnementsniveaus van Gemini, maar elk abonnement krijgt een ander gebruiksbudget.
AI Plus-abonnees: krijgen ongeveer 2× hogere limieten dan het gratis niveau.
AI Pro-abonnees: krijgen ongeveer 4× hogere limieten dan het gratis niveau.
AI Ultra-abonnees: kunnen aanzienlijk hogere limieten krijgen, afhankelijk van het product en de gebruikte functies.
Tijdens Google I/O 2026 introduceerde het bedrijf ook het AI Ultra-abonnement van $100/maand, dat aanzienlijk hogere gebruikslimieten biedt – zoals een vijf keer hogere limiet in de Antigravity-codeeromgeving vergeleken met AI Pro.
Met andere woorden: het belangrijkste verschil tussen abonnementen is niet langer alleen de toegang tot functies, maar de hoeveelheid compute-budget die beschikbaar is voor de gebruiker.
Waarom gebruikers zo snel hun limieten bereikten
Het directe probleem was voorspelbaarheid. Onder het oude systeem konden gebruikers grofweg inschatten hoeveel prompts ze nog hadden. Met compute-quota verdween die voorspelbaarheid grotendeels.
Omdat het gebruik afhangt van de complexiteit van de taak, kunnen zware workloads het budget veel sneller opmaken dan verwacht. Voorbeelden hiervan zijn:
Lange codeersessies
Agent-achtige werkstromen
Mediageneratie of geavanceerde redeneerfuncties
Uit rapporten van ontwikkelaars en gebruikers bleek dat intensieve sessies de vijf-uurslimiet of zelfs de wekelijkse limiet na slechts een paar werksessies konden uitputten.
Veel abonnees voelden zich overvallen door de verandering. Sommigen noemden de nieuwe limieten een "bait-and-switch" en betoogden dat hun betaalde abonnementen nu minder praktisch gebruik opleverden dan voorheen – ook al had Google de officiële abonnementsniveaus technisch gezien niet verlaagd.
De noodreparatie van Google: limieten verhogen
De backlash leidde tot een snelle reactie van Google, vooral binnen Antigravity, de AI-gestuurde codeertool van het bedrijf.
Binnen enkele dagen na de uitrol:
Google verdrievoudigde de Gemini-model snelheidslimieten in Antigravity.
Het reset de wekelijkse quota voor gebruikers zodat ze direct konden blijven werken.
Kort daarna verdrievoudigde Google de limieten opnieuw, waardoor het beschikbare compute-budget voor ontwikkelaars die de tool gebruikten verder werd uitgebreid.
De snelle aanpassingen suggereren dat Google had onderschat hoe snel real-world workflows – met name programmeren en agent-gebaseerde taken – de nieuwe quota zouden verbruiken.
Wat deze aflevering onthult over de AI-economie
De controverse benadrukt een groeiende spanning in de AI-industrie.
Moderne AI-systemen hebben geen uniforme kosten. Een kort tekstantwoord kan goedkoop zijn om te genereren, terwijl redeneren met een lange context, codeeragents of videogeneratie aanzienlijk meer rekenkracht vereisen. Dat maakt eenvoudige "aantal berichten"-limieten steeds onrealistischer voor aanbieders om vol te houden.
Compute-quota lossen de economische kant van dat probleem op – maar ze introduceren een bruikbaarheidsuitdaging. Wanneer limieten afhangen van ondoorzichtige berekeningen over complexiteit, kunnen gebruikers moeite hebben om te voorspellen hoeveel toegang ze eigenlijk hebben.
De uitrol van Gemini door Google illustreert deze afweging duidelijk: een systeem dat was ontworpen om gebruik af te stemmen op computekosten, zorgde voor verwarring bij gebruikers en leidde bijna onmiddellijk tot een backlash.
Voor AI-bedrijven die grote modellen opschalen, is de uitdaging voor de toekomst het balanceren van drie concurrerende krachten:
Stijgende inferentiekosten voor geavanceerde AI-functies
Duidelijke, voorspelbare limieten die gebruikers begrijpen
Abonnementen die nog steeds waardevol aanvoelen voor betalende klanten
Naarmate AI-assistenten krachtiger – en rekenintensiever – worden, zal die balansoefening waarschijnlijk een van de bepalende productuitdagingen van de industrie worden.
support.google.comChanges to Gemini model access and limits