TL;DR
Het contextvenster is het eindige deel van het gesprek dat een AI op elk willekeurig moment kan "zien" — alles daarbuiten houdt op te bestaan voor het model. Houd dat venster klein, schoon en gewijd aan één onderwerp, en de AI blijft scherp, snel en goedkoop in gebruik.
De analogie
Stop met je AI voor te stellen als een geest. Stel je jezelf voor de meest briljante kantoorbediende terwijl, werkend aan een bureau dat exact vier voet breed is.
Elk bericht dat je stuurt is een vel papier dat aan de rechterkant van het bureau wordt gelegd. En hier is het enige onwrikbare ritueel van de bediende: om elk antwoord te schrijven herleest hij elk vel dat op dat moment op het bureau ligt — van links naar rechts, elke keer, zonder uitzondering. Geen diagonaal lezen. Geen "dat herinner ik me nog." Volledige herlezing, bij elk antwoord, voor altijd.
Nu het brute detail: het bureau groeit nooit. Het is met een vaste maat gebouwd in de fabriek. Wanneer er een nieuw vel aankomt en er geen ruimte meer is, glijden de oudste vellen van de linkerkant — niet in een la, niet in een archiefkast, maar in een versnipperaar. De bediende rouwt niet om ze. De bediende merkt niet eens dat ze weg zijn.
Dat bureau is het contextvenster. Als mensen zeggen "de AI vergat mijn instructies" is er geen vergeten gebeurd. De pagina met die instructies gleed gewoon van de rand. De bediende is nog steeds briljant — het bureau is alleen te vol.
Nog één detail, omdat het telt voor je portemonnee: deze bediende rekent per vel. Omdat elk antwoord een volledige herlezing van het bureau vereist, betaal je voor elk gegenereerd woord meer naarmate je meer rommel er laat liggen. Een vol bureau is niet alleen een verwarde bediende — het is een dure.
Hoe het werkt & Uzu's chatlimieten
Onder de motorkap "herinnert" een groot taalmodel je gesprek niet — het herleest het, elke beurt. De tekst die het kan zien wordt gemeten in tokens (zie een token als ongeveer drie kwart van een woord), en het zichtbare gebied is het contextvenster. Wat erin past wordt gelezen; wat er niet in past wordt samengevat of weggegooid.
Dit ligt er op elk willekeurig moment feitelijk op het bureau:
| Wat er op het bureau ligt | Wat het voor jou betekent |
|---|---|
| Systeeminstructies | De staande orders van de AI — nemen al ruimte in voordat je iets zegt |
| Persona's en rollen | Een karakterblad dat de bediende vóór elk antwoord herleest |
| Je recente berichten | De nieuwste vellen — altijd volledig zichtbaar |
| De antwoorden van de AI zelf | Ja, het herleest wat het zei ook — lange antwoorden verdringen jou |
| Bijlagen en geplakte tekst | Veruit de zwaarste vellen op het bureau |
Precies daarom werkt een techniek als de one-shot prompt zo goed: een complete, precieze instructie blijft op het bureau liggen en werkt voor je, beurt na beurt. Het is ook waarom few-shot prompting — kant-en-klare voorbeelden in je prompt plakken — krachtig maar duur in bureauruimte is: elk voorbeeld is een vel dat de bediende voor altijd herleest.
Omdat context een hulpbron is, behandelt de app Uzu het ook zo. Uzu stuurt ongeveer de laatste twintig berichten van een chat mee en comprimeert oudere beurten automatisch naar een samenvatting — zie het als een bediende die periodiek de oudste vellen niet tot een dunne rapportage niet, zodat de belangrijke lijn overleeft zonder dat het bureau overstroomt. En Uzu stelt bewust een limiet aan het aantal gelijktijdige chats dat je open kunt houden, met ruimte die met je niveau meegroeit. Elke open chat is nog een bureau dat je onderhoudt, dus dode gesprekken zijn niet alleen rommel — ze verdringen het werk dat ertoe doet.
De economie hangt ook samen: elke token die het model herleest is een verwerkte token, en dat is de reden dat een schoon contextvenster minder G-Credits kost dan een vervuild. Precisie bespaart twee keer geld — één keer wanneer je de prompt schrijft, en opnieuw bij elke beurt daarna.
Dus de werkregel is simpel:
Eén bureau, één taak. Eén onderwerp per chat, het wezenlijke op de pagina, rommel vernietigd voordat het je kost.
Veelvoorkomende valkuilen
- Een eeuwige chat voor je hele leven draaien. De chat waarin je een reis plant, dan een huurcontract vraagt, dan een recept debugt is een bureau begraven onder ongerelateerd papier. Elk nieuw onderwerp verdient een nieuwe chat — vers bureau, volledige aandacht.
- Instructies herhalen die nog zichtbaar zijn. Als je one-shot prompt twaalf berichten geleden landde en het gesprek nog kort is, geeft een herformulering alleen tokens uit aan herformulering. Herhaal een regel pas wanneer die duidelijk van de rand is gegleden — lange gesprekken, ontbrekende beperking.
- Een veertig pagina's tellend document plakken om één vraag te stellen. Het zwaarste vel op elk bureau is een rauwe documentdump. Extraheer eerst de relevante sectie, of gebruik een tool die ervoor gebouwd is — in Uzu worden bijgevoegde pdf's blijvende context die efficiënt wordt geraadpleegd in plaats van bij elk bericht volledig te worden meegestuurd.
- Het venster verwarren met geheugen. Het contextvenster is werkruimte, geen opslag. Het is een bureau, geen harde schijf — sluit de chat en het bureau wordt schoon geveegd. Alles wat je wilt houden moet bewust worden opgeslagen (opgeschreven, of opgeslagen als een geheugen die je app ondersteunt).
- Ruziën met een AI die "vergat". Als het model een oude instructie tegenspreekt is het niet koppig — de pagina viel van het bureau. Bestrijd niet het symptoom; herhaal de kritieke beperking, of start een schonere chat waar die bovenaan ligt.
FAQ
Wat is een contextvenster in AI?
Het contextvenster is de maximale hoeveelheid tekst — gemeten in tokens — die een AI-model in één keer kan verwerken. Het omvat je instructies, de gespreksgeschiedenis, de eigen eerdere antwoorden van de AI en eventuele bijgevoegde documenten. Alles buiten het venster kan het huidige antwoord niet beïnvloeden, en dat is de reden dat lange gesprekken uiteindelijk hun vroegste instructies "verliezen".
Waarom vergeet AI dingen die ik eerder in hetzelfde gesprek zei?
Omdat het model ze nooit echt heeft opgeslagen — het herleest alleen wat er in zijn contextvenster past. Naarmate het gesprek groeit, vallen oudere uitwisselingen buiten het venster en worden samengevat of weggegooid. De AI is niet slordig; de vroegste pagina's zijn letterlijk uit het zchriftveld verdwenen.
Is een groter contextvenster hetzelfde als AI-geheugen?
Nee, en de twee verwarren veroorzaakt eindeloze frustratie. Een contextvenster is tijdelijke werkruimte: het bestaat zolang het gesprek bestaat en wordt elke beurt herlezen. Geheugen — zoals de opgeslagen feiten- en ophaalsystemen die sommige apps bieden — is een aparte, bewuste opslaglaag die langer meegaat dan één chat. Groot venster: een breder bureau. Geheugen: een archiefkast. Je wilt beide, en ze doen verschillend werk.
Volgende les
Hier is wat niemand beginners waarschuwt: alles hierboven werkt nog steeds perfect wanneer de AI zich vergist. Een model spreekt je instructies minder tegen wanneer zijn bureau schoon is — maar het kan nog steeds een onwaarheid uitspreken met volledige, rustige zekerheid. Dat is geen bug in je prompting. Het is de illusie van zekerheid, het ingebouwde pokergezicht in elk groot taalmodel, en het leren erdoorheen kijken is de belangrijkste verdedigingsvaardigheid in AI.
Ga door naar de volgende les: De illusie van zekerheid
Oefendrill voor je gaat: open je langstlopende chat en lees die als een bureau-inspecteur. Welke vellen verdienen nog hun plek — en welke gleden drie onderwerpen geleden van de rand? Start je volgende chat schoon, en merk het verschil in het allereerste antwoord.