Cena AI modelov klesá: GPT-5.6 Luna o 80 %
OpenAI zlacnilo dva modely radu GPT-5.6. Čo to naozaj mení v obchodnom prípade vašich projektov a kde ostáva háčik.

Cena AI modelov klesá a OpenAI to práve potvrdilo číslami. 30. júla 2026 spoločnosť znížila ceny API pre dva lacnejšie modely radu GPT-5.6: Lunu o približne 80 percent a Terru o 20 percent. Vlajkový Sol ostal bez zmeny. Pre firmy, ktoré si počítajú obchodný prípad AI projektu, sa tým mení jedna premenná v tabuľke. Nič viac, nič menej.
Poďme k číslam, lebo tu sa rozhoduje. Podľa CNBC stojí GPT-5.6 Luna teraz 0,20 USD za milión vstupných tokenov a 1,20 USD za milión výstupných; predtým to bolo 1,00 a 6,00 USD. Terra klesla na 2,00 a 12,00 USD z pôvodných 2,50 a 15,00 USD, čo potvrdzuje aj Reuters. Sol drží 5,00 a 30,00 USD.
Prečo cena AI modelov klesá práve teraz
Nie je to náhoda a nie je to štedrosť. Reuters krok rámcuje jasne: OpenAI znižuje ceny menších modelov „as businesses scrutinize AI spend“, teda vo chvíli, keď firemní zákazníci prísnejšie hodnotia, koľko za AI míňajú. Preklad z manažérčiny: pilotov bolo veľa, faktúr tiež, návratnosti menej.
Axios opisuje Lunu ako „the fastest and lowest cost version of the new model“, Terru ako strednú triedu. OpenAI teda tlačí cenu tam, kde má objem a konkurenciu, a vlajkový model necháva na plnej sadzbe. Ide o klasickú cenovú segmentáciu, nie o plošné zlacnenie.
Čo to naozaj mení v obchodnom prípade
Osemdesiat percent zľavy na vstupe znie ako polovica projektu zadarmo. V praxi sa tým mení jedna položka z troch. Cena inferencie je len časť celkových nákladov, a spravidla nie tá najdrahšia. Rozdeľme to:
- Náklady na tokeny. Práve klesli. Ak beží aplikácia na Lune s vysokým objemom volaní, mesačná faktúra sa reálne zníži.
- Náklady na spoľahlivosť. Evaluácia?Systematické testovanie kvality výstupov modelu na vlastných dátach, aby sa overilo, či lacnejší model stačí pre daný prípad., testovanie výstupov, ošetrenie halucinácií, monitoring. Tie sa zlacnením modelu nepohnú.
- Náklady na ľudí a integráciu. Architektúra, dátové pipeline, dohľad, právne posúdenie. Najdrahšia a najstálejšia časť.
Keď sme v produkcii spúšťali systém, ktorý oslovoval tisíce potenciálnych zákazníkov bez ľudského zásahu, o rentabilite nikdy nerozhodla cena za token?Základná jednotka textu pre jazykový model, zhruba časť slova. Ceny API sa účtujú za milióny tokenov na vstupe a výstupe.. Rozhodlo, koľko výstupov bolo použiteľných bez opravy. Lacnejší token pomáha škálovať to, čo už funguje. Nezachráni to, čo nefunguje.
Ak práve stojíte pred rozhodnutím, či AI zámer vyvinúť interne, kúpiť hotové riešenie alebo integrovať, cena inferencie je len jeden riadok v oveľa väčšej tabuľke. Kto chce mať tú tabuľku poctivo prepočítanú za celý životný cyklus, nájde metodiku v našom workshope o investičnom rozhodnutí vyvinúť verzus kúpiť pre vedenie firmy, kde sa počítajú aj náklady, ktoré v cenníku modelu nikdy neuvidíte.
Kde ostáva háčik pri produkčnom nasadení
Lacnejší model zvádza k tomu, aby ste ho nasadili na viac úloh. Práve v tej chvíli sa objaví problém. Menší a rýchlejší model ako Luna nemá kvalitu vlajkového Sola, a pri náročnejších úlohách to bude vidieť na výstupe. Zľava neznamená, že Luna zvládne to, čo doteraz robil drahší model.
Verejné zdroje publikované po oznámení, vrátane Axios a Yahoo Finance, uvádzajú ceny a pozicionovanie modelov, no nie detailné nové technické podmienky nasadenia: žiadne nové limity priepustnosti, SLA ani obmedzenia. Znamená to, že pred migráciou na lacnejší model treba vlastnou evaluáciou overiť, či pre váš konkrétny prípad neklesla aj kvalita. Rozdiel medzi benchmarkom a produkciou sme rozobrali aj pri Claude Opus 5 v praxi.
Pridáva sa európsky rozmer. Pre firmu v EÚ nie je cena jediná premenná. Podľa AI Act záleží na tom, či ste poskytovateľ alebo nasadzovateľ?Podľa AI Act firma, ktorá model používa vo vlastnom procese. Má iné povinnosti než poskytovateľ, ktorý model vyvíja a dodáva. modelu, aké dáta cez API posielate a ako dokladujete dohľad nad výstupmi. Lacnejšia inferencia?Fáza, keď natrénovaný model spracúva vstup a generuje odpoveď. Za inferenciu sa platí podľa počtu spracovaných tokenov. môže zvádzať k tomu, aby ste AI pustili na viac procesov, čím rastie aj regulačná a vendor expozícia. Kto rieši spoľahlivé produkčné nasadenie s architektúrou, ktorá počíta aj s rolami podľa AI Act, nájde prakticky orientovaný obsah vo workshope o produkčnej AI, RAG a agentových architektúrach pre CTO a architektov.
Čo s tým urobiť tento týždeň
Zľava je príležitosť, ak ju použijete na chladný prepočet, nie na euforické rozšírenie. Konkrétne kroky:
- Prepočítajte reálnu úsporu na svojom skutočnom objeme tokenov, nie na PR percentách.
- Otestujte, či Luna alebo Terra drží kvalitu pre vaše úlohy, na vlastných dátach a s vlastnou evaluáciou.
- Skontrolujte, či nižšia cena nezvádza k nasadeniu tam, kde chýba dohľad nad výstupmi a právne krytie.
Klesajúca cena inferencie je dobrá správa a bude pokračovať. Kto v roku 2027 postaví projekt len na tom, že token zlacnel, postaví ho na piesku. Zľava rieši faktúru. Nasadenie rieši dôveru. A tá stojí rovnako ako predtým.
Časté otázky
Kedy sa oplatí prejsť na lacnejšiu Lunu a kedy radšej zostať na drahšom Sole?
Luna je najrýchlejšia a najlacnejšia verzia, vhodná na úlohy s vysokým objemom volaní, kde stačí nižšia kvalita výstupu. Sol drží plnú sadzbu 5,00 a 30,00 USD za milión tokenov a hodí sa na náročnejšie úlohy, kde záleží na presnosti. Odporúča sa otestovať, či Luna zvládne vašu úlohu bez nárastu chýb.
O koľko sa reálne zníži moja mesačná faktúra vďaka zľave 80 percent?
Zlacnenie sa týka len ceny tokenov, teda inferencie. Podľa článku ide o jednu z troch nákladových položiek a spravidla nie tú najdrahšiu. Ak beží aplikácia na Lune s veľkým objemom volaní, faktúra za tokeny klesne výrazne. Náklady na spoľahlivosť, monitoring a integráciu sa však zlacnením modelu nepohnú.
Prečo OpenAI znížilo ceny práve teraz?
Podľa Reuters ide o reakciu na to, že firemní zákazníci prísnejšie hodnotia svoje výdavky na AI. Pilotných projektov bolo veľa, faktúr tiež, no návratnosti menej. OpenAI tlačí cenu tam, kde má objem a konkurenciu, teda pri menších modeloch, a vlajkový Sol necháva na plnej sadzbe. Ide o cenovú segmentáciu, nie o štedrosť.
Aké náklady zlacnenie modelu nepokryje?
Zostávajú náklady na spoľahlivosť: evaluácia, testovanie výstupov, ošetrenie halucinácií a monitoring. Ďalej náklady na ľudí a integráciu, teda architektúra, dátové pipeline, dohľad a právne posúdenie. Tieto položky sa lacnejšou inferenciou nezmenia a v mnohých projektoch tvoria väčšiu časť rozpočtu než samotné tokeny.
Ako presne sa zmenili ceny jednotlivých modelov radu GPT-5.6?
Luna stojí teraz 0,20 USD za milión vstupných tokenov a 1,20 USD za výstupné, predtým to bolo 1,00 a 6,00 USD. Terra klesla na 2,00 a 12,00 USD z pôvodných 2,50 a 15,00 USD. Sol ostáva bez zmeny na 5,00 a 30,00 USD. Zdrojom čísel sú CNBC a Reuters.
Oplatí sa kvôli nižšej cene vlastný projekt namiesto nákupu hotového riešenia?
Cena inferencie je len jedna premenná v obchodnom prípade a klesla len pri dvoch lacnejších modeloch. Rozhodnutie vyvinúť vlastné riešenie alebo kúpiť hotové by nemalo stáť len na cene tokenov; treba zarátať náklady na spoľahlivosť, integráciu a dohľad, ktoré zľava neovplyvní.
Diskusia
Zatiaľ tu nie sú žiadne komentáre. Buďte prvý.
Čítajte ďalej
Viac zo sekcie Nástroje & modely →
ARC-AGI 3 benchmark: prečo skóre bez kontextu klame
Rozdiel medzi pôvodným výsledkom pod jedným percentom a neskorším skóre okolo 30 percent na ARC-AGI 3 rozpútal spor o tom, či benchmark handicapoval agentov. Ukazuje predovšetkým to, že benchmarkové číslo bez konfigurácie nič nehovorí.

Kimi K3 a GLM 5.2: benchmarky verzus produkcia
Nové čínske open-weight modely Kimi K3 a GLM 5.2 sa v kóderských a agentných benchmarkoch tesne približujú k americkým frontier modelom. Nezávislé dôkazy o ich spoľahlivosti v reálnej produkcii však zatiaľ chýbajú.

Claude Opus 5 v praxi: demo verzus produkcia
Anthropic uviedol 24. júla 2026 Claude Opus 5, model zameraný na agentické kódovanie za cenu predchádzajúcej generácie. Virálne ukážky z komunít zatiaľ nikto nezávisle nepotvrdil, overiteľné sú cena, kontext a technické parametre.

Distilácia AI modelov: lacnejší výkon, ktorý desí giganty
Distilácia AI modelov je technika, pri ktorej sa menší model trénuje na výstupoch väčšieho a získava takmer rovnaké schopnosti za zlomok nákladov. Za pár mesiacov sa z nej stala téma číslo jeden od Silicon Valley po Washington.
Kimi K3: čínsky open model, ktorý rozochvel Silicon Valley
Moonshot AI 27. júla 2026 sprístupnil na stiahnutie váhy modelu Kimi K3 s 2,8 bilióna parametrov. Ide o prvý otvorený model triedy 3T, ktorý sa parametrami blíži uzavretým systémom typu GPT a Claude.

Claude Opus 5: špičkový výkon za cenu Opus 4.8
Anthropic uviedol Claude Opus 5 za rovnakú cenu ako Opus 4.8, no s viac než dvojnásobným výkonom v agentovom kódovaní. Pre firmy to znamená viac hotovej práce za rovnaký rozpočet, ak zvládnu retest agentov a vyššiu mieru halucinácií.