V skratke
  • Claude Opus 5.5 (Anthropic, 22. 9.): 4 USD vstup / 20 USD výstup za milión tokenov, o 20 % menej než Opus 5. Čítanie z cache kleslo z 0,50 na 0,20 USD. Anthropic hlási výkon na úrovni Fable 5.1 na väčšine práce a o 40 % nižšie náklady na typickú úlohu.
  • GPT-6 Sol (OpenAI, 22. 9.): 2 / 10 USD, presne polovica ceny GPT-5.6 Sol. GPT-6 Luna: 0,10 / 0,50 USD, teda sedemkrát lacnejšia než Gemini 3.8 Flash.
  • Medzi vlajkovými modelmi za 10 / 50 USD a lacnou triedou vznikla stredná trieda, ktorá pred týždňom v tejto podobe neexistovala. Práve tam patrí väčšina úloh, kde ide o úsudok.
  • Háčiky: Opus 5.5 sa nedá spustiť bez „uvažovania“, čísla o výkone sú od výrobcov a každá zmena modelu znamená test na vlastných dátach.

Pred tromi týždňami sme písali, že dva najsilnejšie modely na trhu sa zhodli na cene 10 a 50 dolárov za milión tokenov. V utorok 22. septembra sa tí istí dvaja výrobcovia v ten istý deň pustili do stredu trhu. Anthropic vydal Claude Opus 5.5, OpenAI vydalo GPT-6 Sol a GPT-6 Luna. Spoločný menovateľ nie je nový rekord v benchmarku, ale cenník: takmer vlajkový výkon za pätinu až dve pätiny vlajkovej ceny. Pre firmu, ktorá si v lete prepočítavala AI automatizáciu a vyšlo jej, že sa neoplatí, je to dôvod prepočítať to znova.

Čo vyšlo, bez marketingu

Claude Opus 5.5

Nástupca Opus 5. Stojí 4 doláre za milión vstupných a 20 dolárov za milión výstupných tokenov, Opus 5 stál 5 a 25. Väčšia zmena je v cache: čítanie už raz poslaného kontextu kleslo z 0,50 na 0,20 dolára za milión tokenov, zápis do cache z 6,25 na 5 dolárov. Anthropic k tomu tvrdí, že model dokončí rovnakú úlohu s menším počtom tokenov, takže typická agentická práca vyjde zhruba o 40 % lacnejšie než na Opus 5. Výkon má byť na väčšine práce na úrovni Fable 5.1, ktorá stojí 10 a 50 dolárov, a na troch testoch agentickej práce v termináli a v kóde ju podľa výrobcu prekonáva. Dostupný je cez API aj na Amazon Web Services, Google Cloud a Microsoft Azure.

Dve zmeny, ktoré v titulkoch nebudú. Po prvé, Opus 5.5 sa už nedá spustiť bez režimu uvažovania. Model pred odpoveďou vždy premýšľa, čo je pri zložitej úlohe výhoda a pri triedení e-mailov zbytočné výstupné tokeny navyše, teda tie za 20 dolárov. Po druhé, väčšinu úloh z oblasti kybernetickej bezpečnosti model automaticky presmeruje na starší Opus 4.8 a na prácu s biologickými dátami treba overenie. Bežnej firmy sa to netýka, ale kto stavia agenta, ktorý má napríklad kontrolovať bezpečnosť vlastného webu, má s tým rátať.

GPT-6 Sol a GPT-6 Luna

Dvaja menší súrodenci GPT-6 Astra, ktorá vyšla 3. septembra. Sol je model na bežnú náročnejšiu prácu, teda písanie a kontrolu kódu, analýzu dát a viackrokové úlohy, a stojí 2 doláre za milión vstupných a 10 dolárov za milión výstupných tokenov. GPT-5.6 Sol stál 4 a 20, zlacnenie je presne polovičné. Luna je objemový model na úlohy s jasným zadaním, teda zhrnutia, vyťahovanie údajov z dokumentov a rýchle odpovede, za 0,10 a 0,50 dolára. GPT-5.6 Luna stála 0,20 a 1,20. OpenAI tvrdí, že Sol robí zhruba polovicu chýb oproti predchodcovi a blíži sa spoľahlivosti Astry. V API sa modely volajú gpt-6-sol a gpt-6-luna, do platených plánov ChatGPT a do Codexu prichádzajú postupne.

S modelmi prišla aj lepšia cache: opakovane posielaný začiatok promptu, typicky inštrukcie a firemná dokumentácia, má zľavu až 90 % a drží sa aspoň 30 minút od posledného použitia. Vývojár si po novom môže určiť, ktorá časť promptu sa má uložiť, a cache predhriať ešte pred prvým dopytom používateľa. Pre asistenta nad firemnou bázou je to dôležitejšia správa než samotná cena modelu, k tomu sa vrátime nižšie.

Nový cenník: tri triedy namiesto dvoch

  • Vlajková trieda — Claude Fable 5.1 a GPT-6 Astra: 10 / 50 USD za milión tokenov (vstup / výstup)
  • Stredná trieda — Claude Opus 5.5: 4 / 20 USD. GPT-6 Sol: 2 / 10 USD
  • Lacná trieda — Gemini 3.8 Flash: 0,75 / 3,75 USD do 31. 12. 2026, od januára 1,50 / 7,50 USD. GPT-6 Luna: 0,10 / 0,50 USD

Ešte začiatkom septembra bola voľba jednoduchá: buď drahý model za 10 a 50 dolárov, alebo lacný za menej než dolár, a medzi nimi Opus 5 za 5 a 25. Dnes je stred obsadený dvoma modelmi, ktoré výrobcovia sami stavajú vedľa svojich vlajkových lodí. A na spodku Luna podliezla Gemini Flash sedemnásobne, pričom Flash od januára zdražie na dvojnásobok. Všetky ceny sú v dolároch bez DPH a čísla o výkone sú zatiaľ od výrobcov, nezávislé merania prídu o týždne.

Čo to znamená v číslach: dva modelové príklady

Triedenie pošty

Firma, ktorá nechá AI prečítať a roztriediť 5 000 e-mailov mesačne s krátkym návrhom odpovede, pošle modelu zhruba 7,5 milióna tokenov a dostane späť 1,5 milióna. Na Lune to stojí 1,50 dolára mesačne, na Sol 30 dolárov, na Opus 5.5 60 dolárov a na Fable 5.1 alebo Astre 150 dolárov. Pri tomto type úlohy je cena modelu nepodstatná oproti cene integrácie a jediná otázka je, ktorý z lacných modelov robí na vašich e-mailoch najmenej chýb.

Asistent nad firemnou dokumentáciou

Asistent na webe alebo pre zamestnancov, ktorý má v kontexte firemnú bázu s 50 000 tokenmi (zhruba sto strán textu) a mesačne odbaví 3 000 rozhovorov po štyroch otázkach, načíta tú bázu z cache dvanásťtisíckrát, teda 600 miliónov tokenov. Na Opus 5 to bolo 300 dolárov mesačne, na Opus 5.5 je to 120 dolárov, na Sol rovnako 120 a na Lune 6 dolárov. Nové otázky a odpovede sú pri tom objeme drobné. Toto je miesto, kde sa dnešné zlacnenie prejaví najviac: nie v cene za nový token, ale v tom, koľko stojí model, ktorý si pamätá.

Ktoré úlohy sa tým prepočítajú

Úlohy odložené kvôli cene drahého modelu

Revízia zmlúv, kontrola zložitejších dokladov, agent, ktorý sám prejde interný systém a doplní záznamy. Doteraz platilo, že na tieto úlohy treba vlajkový model, a jeho cena návratnosť často zabila. Ak Opus 5.5 a Sol robia to, čo tvrdia výrobcovia, ide o rovnakú prácu za 60 až 80 % menej než na vlajkovom modeli. Otestujte ich na vlastných vzorkách, nie na benchmarku.

Objemové rutiny, ktoré už bežia na lacnom modeli

Extrakcia z dokladov, klasifikácia, zhrnutia, preklady. Luna je sedemkrát lacnejšia než Gemini Flash a Flash od januára zdražie. Znie to ako jasná výmena, ale nie je: pri lacnej triede je účet za model taký malý, že rozhoduje výhradne chybovosť. Model, ktorý ušetrí päť dolárov mesačne a raz za deň zle prečíta sumu na faktúre, je drahší než ten predchádzajúci.

Asistenti a agenti, ktorí stoja na cache

Chatbot nad znalostnou bázou, agent, ktorý pri každom kroku znova číta inštrukcie a doterajšie výsledky. Tu je zlacnenie najväčšie a týka sa oboch výrobcov naraz. Podmienkou je, aby integrácia s cache pracovala vedome, teda aby sa nemenný kontext posielal vždy rovnako a na začiatku. Ak si toto niekto pri stavbe neustrážil, dnešné zľavy sa na jeho účte neprejavia.

Kde je háčik

  • Opus 5.5 vždy uvažuje. Pri jednoduchých úlohách míňa výstupné tokeny na premýšľanie, ktoré nikto nepotrebuje. Na triedenie pošty je nesprávna voľba nie kvôli cene za token, ale kvôli tomu, čo s tokenmi robí.
  • „Polovica chýb“ a „úroveň Fable“ sú tvrdenia výrobcov. Merajú sa na ich testoch. Jediné meranie, na ktorom záleží, je sto vašich dokumentov s ručne overeným výsledkom.
  • Zmena modelu nie je zadarmo ani u toho istého dodávateľa. Iný model odpovedá inak, inak drží formát a inak reaguje na okrajové prípady. Regresný test na vlastných vzorkách je pol dňa práce a preskočiť ho sa nevypláca.
  • Ceny sú v dolároch a menia sa oboma smermi. Gemini Flash od januára zdražie, Sonnet 5 v auguste skončil so zavádzacou cenou. Návratnosť, ktorá funguje len pri dnešnom cenníku, nie je návratnosť.

Kedy vás to nezaujíma

  • Používate AI cez chat — Opus 5.5 aj GPT-6 Sol prídu do platených plánov v rámci predplatného. Nič neriešite.
  • Máte pár dopytov denne — pri stovkách požiadaviek mesačne je rozdiel medzi triedami v jednotkách eur. Vyberajte podľa kvality.
  • Bežíte na lacnom modeli a stačí — prechod na strednú triedu kvôli benchmarkom účet zvýši a pri jednoduchých úlohách výsledok nezmení.

Odložili ste v lete automatizáciu, lebo vyšla draho? Napíšte nám dve vety o tom, čo mala robiť, a do 24 hodín povieme, do ktorej triedy dnes patrí a čo by prevádzka stála pri nových cenách. Zadarmo a bez telefonátov.

Čo s tým spraviť tento mesiac

  • Vytiahnite zo šuplíka prepočty, ktoré nevyšli. Pri strednej triede za 2 až 4 doláre na vstupe môže vyjsť to, čo pri 10 dolároch nevyšlo.
  • Ak máte proces na Opus 5, otestujte Opus 5.5 na vlastných vzorkách. Rovnaké API, nižšia cena, ale vždy zapnuté uvažovanie. Sledujte počet výstupných tokenov, nielen cenu za milión.
  • Pozrite sa, ako vaša integrácia pracuje s cache. Ak nemenný kontext neposiela vždy rovnako a na začiatku, dnešné zľavy vás minú. Býva to hodina práce s najvyšším výnosom.

Časté otázky

Je Claude Opus 5.5 naozaj rovnako dobrý ako Fable 5.1?
Podľa Anthropicu na väčšine práce áno a na troch testoch agentickej práce v termináli a v kóde je aj lepší. Je to však meranie výrobcu na jeho vlastných testoch. Fable 5.1 zostáva modelom na najťažšie uvažovanie a Anthropic ju ďalej predáva za 10 a 50 dolárov. Pre firmu je jediná spoľahlivá odpoveď test na vlastných dokumentoch: sto vzoriek, ručne overený výsledok, porovnanie chybovosti a spotreby tokenov.
Máme proces na Opus 5. Máme prejsť na Opus 5.5?
Pravdepodobne áno, ale nie bez testu. Cena je o pätinu nižšia a čítanie z cache o 60 % lacnejšie, takže účet klesne takmer isto. Opus 5.5 sa však nedá spustiť bez režimu uvažovania, čo pri jednoduchých úlohách zvýši počet výstupných tokenov. Spustite oba modely na rovnakých vzorkách a porovnajte nielen kvalitu, ale aj spotrebu tokenov na jednu úlohu.
Dá sa GPT-6 Luna za 0,10 dolára použiť na niečo vážne?
Na úlohy s jasným zadaním a strojovou kontrolou áno: vyťahovanie údajov z dokladov, triedenie, zhrnutia, preklady. Nie na úsudok nad zložitým dokumentom. Je sedemkrát lacnejšia než Gemini 3.8 Flash, ale pri týchto cenách je účet za model taký malý, že rozhoduje len chybovosť na vašich dátach. Otestujte ju na sto vlastných vzorkách skôr, než niečo prepnete.
Prečo je cena za cache dôležitejšia než cena za vstup?
Asistent nad firemnou bázou aj agent, ktorý pracuje v krokoch, posielajú modelu pri každom dopyte znova ten istý kontext: inštrukcie, dokumentáciu, doterajší priebeh. Ten sa číta z cache a tvorí väčšinu účtu. Opus 5.5 ho číta za 0,20 dolára za milión tokenov, teda za dvadsatinu ceny nového vstupu, a OpenAI dáva na cache zľavu až 90 % a drží ju aspoň 30 minút. Podmienkou je integrácia, ktorá nemenný kontext posiela vždy rovnako a na začiatku.
Čo znamená, že Opus 5.5 presmeruje bezpečnostné úlohy na starší model?
Anthropic väčšinu úloh z kybernetickej bezpečnosti nepúšťa do Opus 5.5 a automaticky ich odbaví starší Opus 4.8. Bežných firemných automatizácií sa to netýka. Rátať s tým má firma, ktorá stavia agenta na kontrolu bezpečnosti vlastných systémov: dostane odpoveď od iného modelu, než si objednala, a mala by to v testoch vidieť.

Záver

Dvadsiaty druhý september nepriniesol nový najlepší model, priniesol lacnejší dobrý model od oboch hlavných výrobcov naraz. Vznikla stredná trieda, v ktorej sa dá kúpiť úsudok za pätinu až dve pätiny vlajkovej ceny, a lacná trieda klesla tak nízko, že o výbere rozhoduje len chybovosť. Najväčšia úspora pritom nie je v cene za token, ale v cache, a tú treba mať v integrácii postavenú. Staviame AI riešenia pre firmy prevažne na Claude, ale tak, aby sa model dal vymeniť. Napíšte nám, ktorý proces ste kvôli cene odložili, a prepočítame ho pri dnešnom cenníku.

Autor Ondrej Remeselník

Zakladateľ a vývojár DataStorm. Vo vývoji softvéru od roku 1999 — weby, aplikácie a systémy pre firmy ako IAD Investments, DPD či SME. Píše z praxe, nie z počutia.