Skip to main content
ENSK
PraxElektrikProJARVISBlog
← Všetky príspevky

GPT-5.6 Luna, Terra a Sol: dodávateľ vám dal do ruky smerovaciu tabuľku

OpenAI sprístupnil GPT-5.6 všetkým 9. júla 2026 ako tri modely s cenami od $1 / $6 po $5 / $30, trinásť dní po obmedzenom náhľade spustenom na žiadosť americkej vlády. Hlavné víťazstvo v indexe nameral hodnotiteľ, ktorý sám píše, že OpenAI pred vydaním pomáhal, a vlastná tabuľka OpenAI ukazuje Sol za Fable 5 na SWE-Bench Pro. O smerovaní rozhoduje cena za dokončenú úlohu na vašej vlastnej eval sade.

TémaPoznámky z terénu
Zverejnené12. 7. 2026
AutorMiroslav Striško
Čítanie7 min

Tento týždeň sprístupnil OpenAI všetkým GPT-5.6: tri modely, Luna, Terra a Sol, s cenami od $1 / $6 po $5 / $30 za milión tokenov. Vydanie prišlo vo štvrtok 9. júla, trinásť dní po obmedzenom náhľade, ktorý OpenAI podľa vlastných slov spustil na žiadosť americkej vlády. Väčšina správ začínala víťazstvom v benchmarku. Podľa nás bol užitočnejším dokumentom cenník.

Dodávateľ dal kupujúcim do ruky smerovaciu tabuľku s tromi riadkami. Číslo, ktoré rozhodne, do ktorého riadku úloha patrí, za vás nezverejní nikto.


Trinásť dní za žiadosťou, ktorú nikto nezdokumentoval

V piatok 26. júna zverejnil OpenAI náhľad GPT-5.6 a otvorene napísal, že nejde o bežné spustenie. „Na ich žiadosť začíname obmedzeným náhľadom pre malú skupinu dôveryhodných partnerov, ktorých účasť bola oznámená vláde, a až potom vydáme modely širšie.“ Prístup bol len cez API a Codex.

V tom istom texte sa OpenAI ohradil: „Nemyslíme si, že takýto proces vládneho prístupu by sa mal stať dlhodobým štandardom. Drží najlepšie nástroje ďalej od používateľov, vývojárov, firiem, kybernetických obrancov a globálnych partnerov, ktorí ich potrebujú.“

CNBC 8. júla napísala, že verejné vydanie príde „zhruba dva týždne“ po obmedzenom spustení. Doplnila kontext: exekutívny príkaz o AI podpísaný v júni žiada vývojárov, aby nové modely dobrovoľne poskytli vláde pred plným vydaním, a federálnym úradom dal 60 dní na prípravu hodnotiaceho procesu. Axios na druhý deň citoval Sama Altmana, ktorý hovoril o „many changes“ po „collaborative back and forth“ s administratívou, teda o mnohých zmenách po vzájomnej výmene pripomienok.

To je celý verejný záznam a záleží na tom, kde končí. OpenAI ani CNBC nemenujú úrad, ktorý o obmedzenie požiadal. Nemenujú ani právny nástroj, o ktorý sa žiadosť opierala. OpenAI píše o žiadosti, nie o príkaze. Nenašli sme žiadny vládny dokument, ktorý by hovoril, čo sa posudzovalo a v čom spočíval súhlas, takže to opisovať nebudeme.

Pre kupujúceho v EÚ praktický záver od týchto detailov nezávisí. Trinásť dní existoval frontier model, mal cenu a volať ho mohli len organizácie, ktorých mená dostala cudzia vláda. Dostupnosť amerického modelu v prvý deň je predpoklad, s ktorým váš plán počíta. Zapíšte ho ako predpoklad.


Tri modely, jedna špecifikácia, tri ceny

Na papieri sú všetky tri modely ten istý stroj v troch veľkostiach. Každý má kontextové okno 1 050 000 tokenov, vstupný strop 922 000 tokenov, 128 000 výstupných tokenov, hranicu znalostí 16. februára 2026 a rovnaký rebríček reasoning.effort: none, low, medium, high, xhigh, max. Dokumentácia OpenAI ich priraďuje k starému názvosloviu. Sol „zhruba zodpovedá modelu bez prípony“, Terra triede mini, Luna triede nano.

  • gpt-5.6-luna$1 vstup · $6 výstup za milión tokenov pri spustení.trieda nano · 9. júl 2026
  • gpt-5.6-terra$2,50 vstup · $15 výstup za milión tokenov pri spustení.trieda mini · 9. júl 2026
  • gpt-5.6-sol$5 vstup · $30 výstup za milión tokenov pri spustení. Alias gpt-5.6 smeruje sem.vlajkový model · 9. júl 2026

S rodinou prišli tri cenové pravidlá a nákladovým modelom pohnú viac než hlavné sadzby. Čítanie z cache si drží zľavu 90 %, no zápis do cache sa teraz účtuje za 1,25× bežnej vstupnej sadzby, s minimálnou životnosťou cache 30 minút. Artificial Analysis to nazvala „prvé modely OpenAI s cenou za zápis do cache“. Prompty nad 272-tisíc vstupných tokenov platia dvojnásobok za vstup a 1,5-násobok za výstup, a to za celú požiadavku. Batch a Flex bežia za 50 % štandardnej ceny.

Jeden detail pre každého, kto si pripína verzie: tieto ID nemajú datovaný snapshot. gpt-5.6-sol je ID modelu aj názov snapshotu.

V ten istý deň vyšiel aj ChatGPT Work, podľa OpenAI „agent v ChatGPT“, ktorý zbiera informácie naprieč aplikáciami a vyrába „hotové materiály ako tabuľky, prezentácie, dokumenty a webové aplikácie“. To je produkt pre koncových používateľov. Kto stavia, toho zaujíma rodina modelov v API.


Víťazstvo v indexe a riadok hneď vedľa

Hlavné tvrdenie OpenAI stálo na indexe Coding Agent Index od Artificial Analysis. Sol pri úsilí max dosiahol 80 bodov, o 2,8 bodu viac než Claude Fable 5 s 77,2, a to „s menej než polovicou výstupných tokenov, za menej než polovičný čas a zhruba o tretinu lacnejšie“.

K tomu číslu patria dve veci. Prvou je priznanie. Artificial Analysis je tretia strana a vo vlastnom texte píše: „Podporili sme OpenAI pri hodnotení modelov GPT-5.6 Sol, Terra a Luna pred vydaním“ (v origináli „We supported OpenAI with pre-release evaluation“). Index páruje každý model s agentovým harnessom, takže Sol bežal v Codexe a modely Claude v Claude Code. Na porovnanie produktov je to rozumný postup. Zároveň je to meranie, pri ktorom dodávateľ asistoval, zverejnené v deň spustenia, a obe strany sa na ňom celkom nezhodnú: Artificial Analysis uvádza cenu Solu za úlohu „~40 %“ pod Fable 5, OpenAI „zhruba o tretinu“.

Druhá vec je vo vlastnej tabuľke výsledkov OpenAI, v tom istom príspevku. Na SWE-Bench Pro má Sol 64,6 %. Claude Fable 5 má 80 % a Opus 4.8 69,2 %. Na Toolathlone dosiahol Sol 58 % oproti 61,7 % pri Fable 5. Všetko sú to čísla, ktoré uvádza dodávateľ, a OpenAI treba uznať, že zverejnil aj riadky, v ktorých prehral.

Zložený index povie, kto vyhral priemer. Vaša záťaž je jeden riadok a môže to byť práve ten, v ktorom víťaz prehral.

Užitočnejšie zistenie z textu Artificial Analysis sa týka stredného modelu. „Luna a Sol sú na Paretovej hranici vždy pred Terrou. Pre každú úroveň úsilia Terry teda existuje úroveň Luny alebo Solu, ktorá ponúkne vyššiu inteligenciu bez príplatku, alebo rovnakú inteligenciu za menej.“ Na ich indexe Intelligence Index stála jedna úloha $1,04 na Sole, $0,55 na Terre a $0,21 na Lune. Podľa tohto merania mala smerovacia tabuľka pri spustení dva živé riadky.

Riadky sa navyše podobajú menej, než naznačuje špecifikácia. Všetky tri uvádzajú rovnaké kontextové okno, no vo vlastnom teste dlhého kontextu od OpenAI (MRCR v2, 8 ihiel, 512-tisíc až 1 mil. tokenov) má Sol 73,8 %, Terra 72,5 % a Luna 41,3 %. Rovnaké okno, iná schopnosť s ním pracovať.

Číslo, na ktorom záleží, teda nie je na žiadnej z týchto stránok. Je ním cena za dokončenú úlohu na vašej vlastnej eval sade: koľko stojí hotová a správna úloha na Lune pri vysokom úsilí oproti Solu pri nízkom, vrátane opakovaných pokusov a zlyhaní. Cena za token je len jeden zo vstupov. Šesť úrovní úsilia krát tri modely dáva mriežku s osemnástimi políčkami a žiadny zverejnený benchmark nepovie, do ktorého políčka patrí vaša kontrola zmlúv alebo triedenie tiketov.


Náš pohľad

Rodina s tromi úrovňami na jednom API a s jedným kontextovým oknom znamená, že dodávateľ uznal argument pre smerovanie. Žiadny model nie je správnou odpoveďou na každé volanie a rozdiel medzi riadkami je dosť veľký na to, aby zaplatil prácu s výberom. Vstupná aj výstupná cena Solu je päťnásobkom Luny.

Čo by sme skontrolovali, než túto rodinu pustíme do produkčnej trasy:

  1. Úrovne sú v písomnej routing policy, jedna trieda úloh na riadok. Model si riadok zaslúži, keď na ňom prejde vaša vlastná eval sada. Karta modelu sa nepočíta a nepočíta sa ani index z dňa spustenia, ktorý dodávateľ pomáhal pripraviť.
  2. Každé volanie sa loguje s modelom, úrovňou úsilia a verziou politiky. Pri ID bez dátumu a cenách, ktoré môže dodávateľ kedykoľvek zmeniť, je tento log jediný záznam o tom, čo bežalo a koľko to stálo.
  3. Cena v politike je strop pre každú trasu. Keď dodávateľ zmení cenu, spustí sa pravidlo a niekto ho posúdi. Nikto sa to nedozvie až z faktúry.
  4. Dátum dostupnosti je riziko a tak ho aj vediete. Trasa, ktorá vie prepadnúť na druhého poskytovateľa alebo na model s otvorenými váhami pod licenciou Apache-2.0 či MIT na hardvéri, ktorý máte pod kontrolou, spraví z trinásťdňovej brány zdržanie.

Úprimný limit tohto článku: nevieme, ktorý úrad o obmedzenie náhľadu požiadal ani na základe akého nástroja, a nevie to nikto, kto vychádza z verejného záznamu. Nepodarilo sa nám ani overiť, aké možnosti uloženia a spracovania dát v EÚ pre tieto modely existujú, takže o nich tu nič netvrdíme.

Sebrona píše routing policy, eval brány a logovanie volaní pre tímy, ktoré prevádzkujú produkčnú AI vnútri EÚ. Ak sa má cenník s tromi riadkami stať položkou vo vašom rozpočte, napíšte na info@sebrona.com.


Zdroje

Každé číslo vyššie pochádza z jednej z týchto stránok. Čísla, ktoré uvádza dodávateľ, sú tak v texte aj označené.

  • Oznámenie GPT-5.6Ceny pri spustení, pravidlá pre cache, dostupnosť, celá tabuľka výsledkov vrátane SWE-Bench Pro, Toolathlonu a MRCR. openai.com/index/gpt-5-6OpenAI · 9. júl 2026 · benchmarky uvádza dodávateľ
  • Previewing GPT-5.6 SolObmedzený náhľad, formulácia „na ich žiadosť“ a námietka OpenAI proti takému procesu. openai.com/index/previewing-gpt-5-6-solOpenAI · 26. jún 2026
  • Dokumentácia OpenAI APIID modelov, kontextové okno, vstupné a výstupné limity, hranica znalostí, úrovne úsilia, priradenie k triedam, cenové pravidlá pre dlhý kontext a Batch, dátumy v changelogu. developers.openai.comOpenAI
  • Artificial AnalysisSkóre 80 v Coding Agent Index, priznanie o hodnotení pred vydaním, cena za úlohu na Sole, Terre a Lune a zistenie o Terre a Paretovej hranici. artificialanalysis.aiArtificial Analysis · 9. júl 2026
  • CNBCNačasovanie vydania, „zhruba dva týždne“ a opis júnového exekutívneho príkazu. cnbc.comCNBC · Ashley Capoot · 8. júl 2026
  • AxiosAltmanove slová „many changes“ a „collaborative back and forth“. axios.comAxios · 9. júl 2026
  • Oznámenie ChatGPT WorkČo je to za produkt a ako ho OpenAI opisuje. openai.comOpenAI · 9. júl 2026