Skip to content

Ako ušetriť tokeny a limity v ChatGPT, Codexe a Claude: 9 pravidiel, ktoré naozaj fungujú

Obsah článku

O autorovi článku

RNDr. Milan Fraňo, PhD. – SEO špecialista a web editor – wooacademy

O autorovi článku

RNDr. Milan Fraňo, PhD. – SEO špecialista a web editor – wooacademy

☕Páčil sa vám článok? Podporte nás likom na YouTube kanál alebo kúpou kávy.

Kto s AI pracuje denne, skôr či neskôr narazí na limit. V ChatGPT sa minú kredity na Codex, v Claude vyskočí hláška o dosiahnutom limite a pri API prekvapí faktúra. Na sociálnych sieťach potom kolujú rady typu „píšte kratšie prompty“. Tie však riešia to najmenej podstatné. Tento návod vysvetľuje, ako ušetriť tokeny tam, kde sa naozaj míňajú: pri výbere modelu, pri dĺžke odpovede a pri kontexte, ktorý so sebou konverzácia ťahá.

Stručne: kde ušetríte najviac

Najväčšiu úsporu prinesie toto poradie:

  1. Lacnejší model na jednoduché úlohy. Rozdiel v cene medzi modelmi býva desaťnásobný až dvadsaťnásobný.
  2. Kratší výstup. Výstupné tokeny sú výrazne drahšie ako vstupné.
  3. Rozumne oddelené konverzácie. Nová téma patrí do nového chatu, jedna úloha by však nemala byť zbytočne rozdelená do mnohých.
  4. Len potrebné súbory a nástroje. Posielajte iba stránky a dáta, s ktorými má model pracovať, a zapínajte len nástroje, ktoré úloha potrebuje.
  5. Až nakoniec kratší prompt. Či má zadanie 200 alebo 400 slov, je pri ostatných položkách zvyčajne zanedbateľné.

Čo sú tokeny a z čoho sa skladá spotreba

Token je kúsok textu, s ktorým model pracuje. Môže to byť celé krátke slovo, časť dlhšieho slova alebo interpunkcia. V slovenčine a ďalších jazykoch s diakritikou a skloňovaním býva na rovnaký text tokenov spravidla viac ako v angličtine.

Spotrebu pri každej odpovedi tvoria:

  • vstup (input): váš prompt, celá doterajšia konverzácia, priložené súbory, výsledky vyhľadávania a nástrojov,
  • výstup (output): text, ktorý model vygeneruje, vrátane „premýšľania“ pri modeloch s uvažovaním (reasoning),
  • cache (cached input): časť vstupu, ktorú systém nedávno spracoval a vie ju znovu použiť za výrazne nižšiu cenu.

Dôležité je, že pri každej ďalšej správe v tom istom chate sa znova spracúva celá doterajšia konverzácia. Preto dlhé chaty postupne „žerú“ čoraz viac.

Koľko to stojí: príklad z Codexu

OpenAI pri Codexe účtuje kredity podľa typu tokenov a zvoleného modelu. Podľa oficiálneho prehľadu cien (september 2026) sú sadzby za 1 milión tokenov takéto:

ModelVstupVstup z cacheVýstup
GPT-5.6 Sol125 kreditov12,5 kreditu750 kreditov
GPT-5.6 Terra50 kreditov5 kreditov300 kreditov
GPT-5.6 Luna5 kreditov0,5 kreditu30 kreditov

Čo z tabuľky vyplýva:

  • výstup je šesťkrát drahší ako vstup,
  • vstup z cache je desaťkrát lacnejší ako nový vstup,
  • Sol je pri výstupe 25-krát drahší ako Luna.

Sadzby sa menia, preto si ich pred väčším projektom vždy overte v aktuálnom cenníku. Princíp však platí aj pri ďalších nástrojoch, vrátane API od OpenAI aj Anthropicu: drahý model, dlhý výstup a veľký kontext sú hlavní „žrúti“.

9 pravidiel, ako ušetriť tokeny

1. Jednoduché úlohy robte na lacnejšom modeli

Prepis textu, meta description, jednoduchá úprava HTML, zhrnutie článku či návrh nadpisov nepotrebujú najsilnejší model. Najvýkonnejší model si nechajte na zložité analýzy, dlhé agentické úlohy a náročné programovanie.

V praxi: v nástroji si zvoľte menší alebo rýchlejší model (napríklad Luna či Terra v Codexe, Haiku či Sonnet v Claude) vždy, keď ide o rutinu. Ak je výsledok slabý, prepnite na silnejší model až potom.

2. Pýtajte si iba taký dlhý výstup, aký potrebujete

Výstup je najdrahšia časť odpovede. Rozdiel medzi odpoveďou s 300 a s 3 000 slovami je pri spotrebe oveľa väčší ako rozdiel medzi krátkym a dlhším promptom.

Namiesto: „Vysvetli mi, ako funguje GEO.“

Napíšte: „Vysvetli GEO v 5 bodoch, bez úvodu a záveru.“

Pomáhajú formulácie ako „max. 5 bodov“, „iba výsledok, bez vysvetľovania“, „bez rekapitulácie“ či „tabuľka s 3 stĺpcami“.

3. Nová téma = nový chat

Keď riešite článok o GEO a potom chcete upraviť zmluvu, starý kontext už nie je potrebný. V pôvodnom chate by sa však spracúval pri každej ďalšej správe. Aj samotní výrobcovia AI nástrojov odporúčajú nepotrebný kontext odstraňovať a príliš veľké vstupy rozdeliť.

4. Jednu úlohu ale zbytočne nedeľte

Opačný extrém je rovnako drahý. Keď do každého nového chatu znova vkladáte 30-stranový podklad, zaplatíte ho zakaždým ako nový vstup. V rámci jednej rozpracovanej úlohy je výhodnejšie zostať v jednom vlákne, kde sa podklady môžu čítať z cache.

5. Súvisiace zadania dávajte naraz

Namiesto série správ: „sprav title“ → „teraz meta description“ → „teraz H1“ → „teraz FAQ“ napíšte jednu:

> „Pre tento článok navrhni title, meta description, H1 a 3 otázky do FAQ. Bez vysvetľovania.“

Ušetríte niekoľko kôl, pri ktorých by sa znova spracúval celý kontext. Aj Anthropic v tipoch k limitom Claude výslovne odporúča zoskupovať súvisiace požiadavky do jednej správy.

6. Posielajte iba potrebné súbory a stránky

Priložený dokument sa započítava do vstupu. Napríklad pri PDF v Claude uvádza dokumentácia Anthropicu zhruba 1 500 až 3 000 tokenov na stranu podľa hustoty textu, a pri vizuálnom spracovaní pribúdajú ďalšie tokeny za obrázky strán. Iné systémy počítajú inak, princíp je však rovnaký. Ak potrebujete analyzovať 4 strany z 200-stranovej príručky, pošlite iba tie 4 strany alebo ich vložte ako text.

7. Opakované podklady dajte do projektu

V Claude platí, že obsah v projektoch sa ukladá do cache a pri opakovanom použití sa do limitu započítava menej ako nový obsah. Brand manuál, tón komunikácie, cenník či zoznam produktov preto patria do projektu, nie do každej novej správy.

8. Nástroje, konektory a agentov zapínajte, iba keď ich treba

Vyhľadávanie na webe, konektory, spúšťanie kódu či práca so súbormi pridávajú do konverzácie veľa textu, a teda aj tokenov. V Claude sa navyše všetka spotreba v claude.ai, Claude Code aj Claude Desktop počíta do spoločného limitu.

Pozor na mýtus, že subagenti vždy šetria. Subagent má síce čistý kontext, no zároveň vykonáva prácu navyše: číta súbory, hľadá a generuje výstup. Podľa údajov Anthropicu spotrebujú agenti typicky asi 4-krát viac tokenov ako bežný chat a systémy s viacerými agentmi asi 15-krát viac. Agentov sa oplatí použiť pri rozsiahlych úlohách, pri ktorých je ich výkon prínosom, nie ako trik na úsporu.

9. Pri drahších úlohách nastavte úsporný režim hneď na začiatku

Vyšší stupeň premýšľania (reasoning, effort) znamená viac tokenov. Pri bežných úlohách ho nechajte na nižšej úrovni a na začiatku drahšieho pracovného chatu dajte modelu jasné pravidlá. Pozrite si hotové prompty nižšie.

Hotové prompty na úsporné používanie AI

Na začiatok pracovného chatu:

> „Pracuj úsporne. Kroky vysvetľuj iba vtedy, keď sa na ne opýtam. Odpovede drž stručné. Web a ďalšie nástroje používaj len vtedy, keď sú nevyhnutné. Keď sa úloha hodí pre lacnejší model, upozorni ma.“

Pri práci s kódom alebo webom (Codex, Claude Code):

> „Prečítaj si iba súbory potrebné na túto úlohu, nie celý projekt. Výsledok zhrň v niekoľkých bodoch, bez opisu toho, čo si robil.“

Pri SEO úlohách:

> „Navrhni 3 varianty title (max. 60 znakov) a 3 meta description (max. 155 znakov). Iba zoznam, bez komentára.“

Ako sledovať spotrebu

  • Claude: na platených plánoch nájdete prehľad v časti Settings → Usage, kde vidíte aktuálne čerpanie aj týždenné limity.
  • ChatGPT a Codex: využitie a kredity sledujte v nastaveniach účtu. Kredity sa dnes používajú najmä pri podporovaných funkciách, napríklad v Codexe, po vyčerpaní spotreby zahrnutej v pláne.
  • API: v konzole poskytovateľa si nastavte mesačný limit výdavkov a upozornenia.

Mýty o šetrení tokenov

TvrdenieRealita
„Najviac ušetríte krátkym promptom.“Prompt je zvyčajne malá časť spotreby. Viac rozhoduje model, dĺžka výstupu a kontext konverzácie.
„Predplatné ChatGPT je denný účet tokenov.“Príliš zjednodušené. Limity sa líšia podľa plánu a modelu. Kredity sa používajú pri vybraných funkciách.
„Každé PDF stojí 1 500 až 3 000 tokenov na stranu.“Tento údaj uvádza Anthropic pre Claude. Iné systémy spracúvajú PDF inak.
„Subagenti vždy šetria tokeny.“Nie. Chránia hlavný kontext, no celková spotreba býva vyššia.
„Každú otázku dávajte do nového chatu.“Pri súvisiacej práci naopak stratíte výhodu cache a podklady platíte znova.

Časté otázky

Čo spotrebuje najviac tokenov?

Najviac zvyčajne dlhý výstup z drahého modelu, veľký kontext dlhej konverzácie, priložené súbory a nástroje ako vyhľadávanie či agenti. Samotná dĺžka promptu býva v porovnaní s tým zanedbateľná.

Je lepšie písať krátke prompty?

Prompt má byť jasný, nie nutne krátky. Presné zadanie ušetrí opravy a ďalšie kolá, ktoré stoja viac ako pár slov navyše. Šetriť sa oplatí hlavne na dĺžke výstupu.

Kedy začať nový chat?

Keď meníte tému alebo keď je konverzácia veľmi dlhá a pôvodný kontext už nepotrebujete. Pri jednej rozpracovanej úlohe s rovnakými podkladmi je výhodnejšie zostať v jednom vlákne.

Čo je cached input?

Časť vstupu, ktorú systém nedávno spracoval a vie ju použiť znova. Je výrazne lacnejšia. Pri Codexe je približne desaťkrát lacnejšia ako nový vstup. V Claude sa takto správa napríklad obsah projektov.

Šetria subagenti tokeny?

Nie automaticky. Udržia čistý hlavný kontext, ale samy vykonávajú prácu navyše. Podľa Anthropicu spotrebujú viacagentové systémy približne 15-krát viac tokenov ako bežný chat.

Ako zistím, koľko som minul?

V Claude v časti Settings → Usage, v ChatGPT a Codexe v nastaveniach účtu a pri API v konzole poskytovateľa, kde si môžete nastaviť aj limity výdavkov.

Zhrnutie

Tokeny neušetríte škrtaním slov v prompte, ale rozumnými rozhodnutiami. Na rutinu používajte lacnejší model, pýtajte si krátke výstupy, oddeľujte nesúvisiace témy, súvisiace zadania dávajte naraz a posielajte iba potrebné podklady. Nástroje a agentov zapínajte vtedy, keď prinášajú výsledok. Poradie úspor si zapamätajte takto: model → dĺžka výstupu → kontext → súbory a nástroje → až potom prompt.

O autorovi

RNDr. Milan Fraňo, PhD.

HEAD of SEO, web editor, co-founder wooacademy

Môj príbeh SEO špecialistu …

SEO konzultácia

Naplánuj si konzultáciu
s našimi profesionálmi.

konzultacia social kampane

Facebook marketing partner – social marketing

HEAD of SEO a web editor – weby & SEO

Google certifikovaná trénerka – Google ads kampane (PPC)

Zanechajte nám kontaktné informácie a pripravíme cenovú ponuku na mieru ?

Marketingové služby na mieru, ozvite sa!