OpenAI zlepšuje prompt caching pre GPT-6, pridáva diagnostiku aj breakpointy
OpenAI upravilo prompt caching pre GPT-6. Vývojári získavajú zdieľanie cache pre rovnaké prefixy, diagnostiku výpadkov a explicitné breakpointy pre stabilný kontext.

OpenAI prompt caching GPT-6 dostáva zmeny určené najmä vývojárom AI aplikácií a agentov. Spoločnosť 22. septembra 2026 oznámila, že zdieľané prefixy vstupov môžu pri opätovnom použití získať cache zľavu v 30-minútovom okne. Súčasťou noviniek je dashboard využitia cache, diagnostika cache missov a explicitné cache breakpointy pre vybrané modely.
Prompt caching umožňuje opätovne využiť už spracovanú stabilnú časť vstupu, namiesto jej opakovaného spracovania pri každom API volaní. Pri dlhších promptoch môže ísť napríklad o systémové inštrukcie, definície nástrojov alebo rozsiahly kontext, ktorý sa medzi krokmi agenta nemení.
OpenAI prompt caching GPT-6 a zdieľané prefixy
Podľa OpenAI sú zdieľané prefixy vstupov oprávnené na cache zľavu, ak sa znovu použijú v rámci 30 minút. Prefixom sa rozumie úvodná, zhodná časť vstupu. Pre vývojárov je preto dôležité, ako prompt usporiadajú: stabilné inštrukcie a kontext majú byť pred často menenými údajmi.
Zmena sa týka API vrstvy. Nejde o novú funkciu alebo schopnosť určenú priamo pre bežných používateľov ChatGPT. Jej význam sa týka najmä prevádzkovateľov aplikácií, ktoré opakovane posielajú modelu veľký objem rovnakého kontextu.
Dashboard a diagnostika cache missov
OpenAI pridalo dashboard využitia cache a diagnostiku cache missov. Pri nevyužití cache môže diagnostika uviesť dôvod výpadku aj odhad počtu dotknutých tokenov. Vývojári tak majú získať lepší prehľad o tom, či sa stabilné časti ich vstupov skutočne opakovane používajú.
Takéto údaje môžu pomôcť odhaliť zmeny v štruktúre promptu alebo konfigurácii požiadaviek, ktoré bránia opätovnému využitiu cache. Dokumentácia zároveň opisuje diagnostické typy pre cache hit aj cache miss a príslušné počítadlá tokenov.
Explicitné breakpointy od GPT-5.6
Pre GPT-5.6 a novšie modely OpenAI dokumentuje explicitné cache breakpointy. Vývojár nimi môže označiť stabilnú časť kontextu, ktorú chce ukladať do cache, bez nutnosti ukladať často sa meniaci koniec promptu.
Táto možnosť je určená pre prípady, keď je dlhý začiatok požiadavky opakovane rovnaký, no záverečná časť obsahuje aktuálne dáta, nový používateľský vstup alebo výsledok predchádzajúceho kroku agenta. Breakpoint má umožniť presnejšie oddeliť tieto dve časti.
Cena zápisu a čítania z cache
Dokumentácia uvádza, že zápis do cache stojí 1,25-násobok bežnej ceny vstupných tokenov. Následné čítanie z cache je účtované sadzbou 0,1-násobku bežnej ceny vstupných tokenov. Cache preto nie je automatickou úsporou pri každom volaní: prínos vychádza z opakovaného použitia rovnakého prefixu.
Pre viac-krokové AI agenty môžu mať tieto mechanizmy význam pri opakovanom odosielaní rovnakých inštrukcií, definícií nástrojov a kontextu. OpenAI však nepublikovalo nezávisle overený všeobecne platný údaj o náraste cache hit rate ani o úspore pre všetkých zákazníkov.
Spoločnosť v súvislosti s cachingom cituje aj tvrdenia zákazníkov, vrátane GitHub Copilot a Manus, o znížení nákladov či vyššom podiele cache hitov. Tieto údaje však ide o zákaznícke tvrdenia prezentované OpenAI, nie o univerzálne výsledky.
Čo sledovať ďalej
- cenové podmienky a dostupnosť noviniek pre konkrétne varianty GPT-6,
- nezávislé merania úspor, latencie a podielu cache hitov v reálnych nasadeniach,
- praktické limity 30-minútovej životnosti cache a vplyv zmien modelu, nástrojov alebo service tieru na opätovné použitie cache.
Zdroje
- OpenAI — Better prompt caching for GPT-6 – Potvrdzuje dátum oznámenia, cieľ zlepšiť caching pre GPT-6, 30-minútové okno, dashboard, diagnostiku a explicitné breakpointy.
- OpenAI API Docs — Prompt caching – Potvrdzuje fungovanie explicitných breakpointov, 30-minútovú minimálnu životnosť cache a účtovanie cache zápisu a čítania pre GPT-5.6 a novšie modely.
- OpenAI API Docs — Prompt cache diagnostics – Potvrdzuje diagnostické typy cache hit a cache miss, uvádzané dôvody výpadkov a význam diagnostických počítadiel tokenov.
Overené a aktualizované: 23. 09. 2026 06:21



