AI-nieuws & uitleg · elke dag
Nieuws

Prompt caching in GPT-6: sneller en goedkoper werken

23 september 2026 · 1 min lezen

OpenAI heeft op 22 september 2026 nieuwe techniek voor prompt caching in GPT-6 aangekondigd. Het model onthoudt vaker delen van je invoer, waardoor reacties sneller komen en het gebruik goedkoper wordt. Voor wie veel met dezelfde instructies of documenten werkt, kan dat flink schelen.

In het kort

  • GPT-6 haalt hogere cachetreffers dan eerdere modellen, volgens OpenAI.
  • Er komen nieuwe diagnosemiddelen om te zien wat wel en niet gecacht wordt.
  • Je kunt zelf breekpunten in een prompt aangeven om caching te sturen.
  • OpenAI belooft minder vertraging en lagere kosten door deze aanpassingen.

Wat is prompt caching ook alweer

Bij prompt caching bewaart het model een deel van je invoer. Stuur je later een prompt die hetzelfde begint, dan pakt GPT-6 dat bewaarde stuk erbij. Dat scheelt rekenwerk.

Het idee is niet nieuw, maar OpenAI zegt dat GPT-6 vaker raak cached dan eerdere versies. Hoe vaker een stuk uit het geheugen komt, hoe minder tokens het model opnieuw hoeft te verwerken.

Hogere cachetreffers en nieuwe diagnose

Volgens OpenAI stijgt het aantal cachetreffers in GPT-6. Een treffer betekent dat een stuk tekst al bekend was. Het bedrijf noemt ook nieuwe diagnosemiddelen. Daarmee zie je welke delen van je prompt wel of niet uit de cache komen.

Dat is handig als je wilt snappen waarom een lang document toch elke keer opnieuw wordt gelezen. Zonder die informatie is caching vaak een blackbox.

Zelf breekpunten zetten

Nieuw is dat je expliciet breekpunten kunt aangeven. Een breekpunt is een plek in je prompt waar het model mag beslissen om de tekst daarvoor te bewaren.

Zo bepaal je zelf welk deel vastligt, bijvoorbeeld een lange systeeminstructie of een handleiding. Alles daarna varieert per vraag. OpenAI zegt dat dit de cache beter laat werken.

Minder vertraging, lagere kosten

OpenAI koppelt de verbeteringen aan minder latency en lagere kosten. Latency is de tijd tussen je vraag en het eerste antwoord. Bij caching hoeft het model minder te doen, dus dat scheelt wachttijd.

Ook de prijs per gebruik daalt in de praktijk, omdat hergebruikte tokens niet volledig meetellen. Hoeveel precies, hangt af van je eigen prompts en valt niet in één getal te vangen.

Wat betekent dit voor Nederland?

Voor Nederlandse bedrijven en ontwikkelaars die GPT-6 via de API gebruiken, kan dit direct schelen op de maandrekening. Zeker als je veel dezelfde instructies of documenten verwerkt, zoals bij klantenservice, juridische teksten of interne kennisbanken. Let wel op de Europese regels rond gegevensverwerking: wat in de cache belandt, valt onder dezelfde afspraken als andere verwerking. OpenAI noemt geen aparte prijzen in euro's of een Nederlandse ingangsdatum, dus dat blijft voorlopig onbekend.

M
Maxims take

Prompt caching is precies het soort verbetering dat je gratis krijgt zonder extra abonnement, dus daar zeg ik geen nee tegen. Maar sneller en goedkoper klinkt mooi tot je zelf meet wat het oplevert, en dat is weer typisch zo'n belofte waarvan ik de cijfers pas vertrouw als ze uit mijn eigen tools komen. Mijn werk gaat in mijn eigen scripts met de API, dus als de cachetreffers daar echt omhoog gaan plak ik dat er gewoon in zonder dat er een nieuw dashboard aan te pas komt.

Veelgestelde vragen

Wat is prompt caching precies?

Het model bewaart een deel van je invoer, zodat het bij een volgende vergelijkbare prompt minder opnieuw hoeft te rekenen. Dat maakt reacties sneller en goedkoper.

Werkt prompt caching in GPT-6 ook voor Nederlandse teksten?

Ja, caching gaat over tokens en niet over de taal. Nederlands werkt dus net zo goed, zolang je prompt maar hetzelfde begint.

Wat kost het en wanneer komt het naar Nederland?

OpenAI heeft geen losse prijzen in euro's of een Nederlandse datum genoemd. De functies horen bij GPT-6 en zijn via de API beschikbaar volgens OpenAI.

Lees ook

Tekst en beeld gemaakt met AI op basis van de genoemde bronnen, de take in de stem van Maxim. Hoe dat werkt.