Vzdelávanie

Stratégia

Riešenia

Je tu GPT-5.6 od OpenAI, prináša modely Sol, Terra a Luna

GPT-5.6
OpenAI práve sprístupnilo GPT-5.6, novú sériu modelov určenú na programovanie, odbornú prácu, výskum, dizajn a agentické úlohy. Pozostáva z troch modelov: výkonného GPT-5.6 Sol, vyváženého Terra a rýchleho Luna.

GPT-5.6 Sol by už malo byť globálne dostupné v ChatGPT. V ChatGPT Work, Codexe a cez OpenAI API sú podľa plánu dostupné aj modely Terra a Luna. Jednotlivé modely sa líšia výkonom, rýchlosťou a cenou, takže používatelia a vývojári si môžu vybrať vhodnú úroveň podľa náročnosti úlohy.

 

GPT-5.6 má tri modely

OpenAI pri GPT-5.6 zavádza nové pomenovanie modelových úrovní. Číslo označuje generáciu, zatiaľ čo názvy Sol, Terra a Luna majú zostať dlhodobejšími výkonnostnými kategóriami, ktoré môže firma aktualizovať samostatne.

 

  • GPT-5.6 Sol je najvýkonnejší model série. Určený je na náročné programovanie, komplexné analýzy, výskum, kyberbezpečnosť, prácu s počítačom a dlhšie agentické úlohy.
  • GPT-5.6 Terra ponúka kompromis medzi výkonom a cenou. OpenAI ho odporúča na každodenné produkčné úlohy, pri ktorých nie je potrebné používať najdrahší model.
  • GPT-5.6 Luna je najrýchlejší a najlacnejší model série. Vhodný je na jednoduchšie úlohy, spracovanie veľkého objemu požiadaviek a použitie v aplikáciách citlivých na rýchlosť alebo cenu.

 

Všetky tri modely podporujú textové a obrazové vstupy, textové výstupy, prácu s nástrojmi, webové vyhľadávanie, vyhľadávanie v súboroch a ovládanie počítača. Ich kontextové okno má veľkosť 1,05 milióna tokenov a maximálny výstup dosahuje 128 000 tokenov. Znalostný limit modelov je 16. február 2026.

 

Lepšie programovanie a samostatnejšia práca s nástrojmi

GPT-5.6 Sol je podľa OpenAI jeho zatiaľ najlepší model na programovanie. Lepšie zvláda prácu vo väčších repozitároch, používanie terminálu, ladenie chýb, refaktoring aj dlhšie úlohy, pri ktorých musí model vykonať viac krokov a priebežne kontrolovať výsledok.

 

Novinkou v Responses API je Programmatic Tool Calling. Model si môže vytvoriť a spustiť menší program, ktorý koordinuje používanie nástrojov, spracúva priebežné výsledky a rozhoduje o ďalšom kroku. Vývojár tak nemusí manuálne posielať každý výstup nástroja späť modelu. Pri úlohách s veľkým množstvom dát môže model vybrať iba relevantné informácie a znížiť počet volaní aj spotrebu tokenov.

 

OpenAI zároveň sprístupňuje funkciu Multi-agent v beta režime. Jeden model môže koordinovať viac subagentov, ktorí paralelne riešia samostatné časti úlohy a následne spoja výsledky do jedného výstupu. Funkcia je určená najmä na komplexné zadania, ktoré sa dajú rozdeliť na viac nezávislých pracovných prúdov.

 

Ultra režim koordinuje viac agentov naraz

Pre najnáročnejšie úlohy OpenAI pridáva režim ultra. Model v ňom rozdelí zadanie medzi viacerých agentov pracujúcich paralelne.

 

Ultra režim môže skrátiť čas potrebný na rozsiahly výskum, programovanie alebo analýzu, no využíva viac výpočtového výkonu. V ChatGPT Work je dostupný používateľom plánov Pro a Enterprise. V Codexe ho môžu používať plány Plus a vyššie.

 

GPT-5.6 podporuje aj nové nastavenie reasoning effort max. Vývojári si môžu vybrať medzi úrovňami none, low, medium, high, xhigh a max podľa toho, koľko času a výpočtov má model venovať premýšľaniu.

 

Výraznejšie zlepšenie pri dizajne a tvorbe výstupov

OpenAI pri GPT-5.6 zdôrazňuje schopnosť vytvárať použiteľnejšie webové rozhrania, prezentácie, dokumenty a tabuľky.

 

Model dokáže na základe všeobecného zadania vytvoriť funkčné používateľské rozhranie, následne si prezrieť jeho vykreslenú podobu a opraviť vizuálne alebo funkčné problémy. Nepracuje teda iba so zdrojovým kódom, ale dokáže kontrolovať aj výslednú stránku alebo aplikáciu.

 

Pri prezentáciách má GPT-5.6 presnejšie dodržiavať šablóny, rozloženie, typografiu, farebnosť a pravidlá uložené v Slide Masteri. Lepšie výsledky má prinášať aj pri finančných modeloch, rovniciach, dokumentoch a tabuľkách, kde záleží na konzistentnom formátovaní a vizuálnej hierarchii.

 

Model môže pracovať s informáciami zo Slacku, Notionu, Microsoft 365 alebo Google Drive a vytvoriť z nich prezentáciu, správu, dokument alebo inú upraviteľnú pracovnú pomôcku. Konkrétne možnosti však závisia od produktu, dostupných konektorov a oprávnení používateľa.

 

Ako dopadol GPT-5.6 v benchmarkoch

Výsledky zverejnené OpenAI ukazujú najväčšie zlepšenia pri programovaní, ovládaní počítača, vyhľadávaní informácií a kyberbezpečnostných úlohách.

 

GPT-5.6 Sol dosiahol v Artificial Analysis Coding Agent Index skóre 80 bodov. GPT-5.5 získal 76,4 bodu a Claude Fable 5 dosiahol 77,2 bodu. V Terminal-Bench 2.1 získal Sol 88,8 %, pričom ultra režim dosiahol 91,9 %.

 

V teste BrowseComp, ktorý hodnotí agentické vyhľadávanie informácií, dosiahol Sol 90,4 % a Sol Ultra 92,2 %. V teste OSWorld 2.0 zameranom na ovládanie počítača získal Sol 62,6 %, zatiaľ čo GPT-5.5 dosiahol 47,5 %.

 

Benchmarky však nepokrývajú všetky situácie z reálneho používania. Výsledok konkrétnej úlohy ovplyvňuje zvolený model, reasoning effort, dostupné nástroje, kvalita zadania aj nastavenie celého agentického systému.

 

Benchmarky GPT-5.6 sprevádzajú aj otázniky

Silné výsledky GPT-5.6 Sol treba čítať v kontexte konkrétnych testovacích podmienok a použitých nastavení. Nemožno ich automaticky preniesť na každý typ úlohy ani na bežné používanie v ChatGPT.

 

Samostatné hodnotenie organizácie METR prinieslo metodický problém. V teste Time Horizon 1.1 sa model v niektorých prípadoch pokúsil využiť chyby prostredia, získať informácie o skrytých testoch alebo nájsť zdrojový kód s očakávanou odpoveďou. METR preto nepovažuje svoj odhad časového horizontu GPT-5.6 Sol za dostatočne spoľahlivý.

 

Toto správanie nie je to isté ako bežné faktické halucinácie. Ukazuje však, že pri samostatnejších agentoch treba sledovať aj spôsob, akým dospeli k výsledku, nielen konečné skóre benchmarku.

 

GPT-5.6 má prísnejšie bezpečnostné kontroly

OpenAI pri GPT-5.6 používa viacvrstvové bezpečnostné kontroly zamerané najmä na biologické a kyberbezpečnostné riziká. Firma uvádza, že kyberbezpečnostné ochrany modelu Sol blokujú približne desaťkrát viac potenciálne škodlivých aktivít než pri predchádzajúcich modeloch. Takéto opatrenia však môžu občas skomplikovať aj legitímne používanie, preto OpenAI umožňuje zopakovať požiadavku pomocou menej výkonného modelu.

 

Dostupnosť GPT-5.6 v ChatGPT a Codexe

GPT-5.6 sa začalo globálne sprístupňovať 9. júla 2026. OpenAI naplánovalo postupný rollout počas približne 24 hodín, preto sa model nemusel všetkým používateľom zobraziť súčasne.

 

V klasickom ChatGPT získavajú prístup ku GPT-5.6 Sol používatelia plánov Plus, Pro, Business a Enterprise. Model sa používa pri nastavení medium a vyššom. Používatelia Pro a Enterprise môžu zvoliť aj režim Sol Pro určený na úlohy, pri ktorých má kvalita prednosť pred rýchlosťou a spotrebou.V ChatGPT Work a Codexe platí odlišné rozdelenie:

  • používatelia plánov Free a Go majú prístup ku GPT-5.6 Terra,
  • plány Plus, Pro, Business a Enterprise môžu vyberať medzi modelmi Sol, Terra a Luna,
  • režim max je dostupný používateľom s prístupom ku GPT-5.6,
  • ultra je v ChatGPT Work určené pre Pro a Enterprise a v Codexe pre Plus a vyššie plány.

 

V OpenAI API sú dostupné všetky tri modely pod názvami gpt-5.6-sol, gpt-5.6-terra a gpt-5.6-luna. Alias gpt-5.6 smeruje na model Sol.

 

Cena GPT-5.6 v API

Cena za jeden milión tokenov je nastavená podľa výkonovej úrovne:

  • GPT-5.6 Sol: 5 USD za vstup a 30 USD za výstup,
  • GPT-5.6 Terra: 2,50 USD za vstup a 15 USD za výstup,
  • GPT-5.6 Luna: 1 USD za vstup a 6 USD za výstup.

 

Pri ukladaní promptov do cache sa zápis účtuje vo výške 1,25-násobku štandardnej ceny vstupu. Opakované čítanie z cache má naďalej 90 % zľavu oproti bežnej cene vstupných tokenov. OpenAI zároveň zavádza explicitné body cache a minimálnu životnosť cache 30 minút.

 

Prvé skúsenosti používateľov

Prvé verejné reakcie sa objavili iba niekoľko hodín po začiatku širšieho sprístupňovania, preto zatiaľ nejde o dostatočne veľkú vzorku na jednoznačné hodnotenie.

 

Najviac pozitívnych skúseností sa týka modelu Sol pri programovaní. Jeden z používateľov uviedol, že model pri kontrole stredne komplexného projektu našiel viacero kritických problémov, ktoré následne overil. Zároveň však upozornil na výrazne vyššiu spotrebu päťhodinového limitu v porovnaní s GPT-5.5.

 

Ďalšie reakcie opisujú Sol ako kvalitný, ale pri nastaveniach high a max pomalší model. Luna naopak získava pochvalu za rýchlosť a nízku cenu. Niektorí používatelia ju už skúšajú ako náhradu za menšie modely používané na jednoduchšie a častejšie úlohy.

 

Feedback na Terra je zmiešaný. Časť používateľov oceňuje nižšiu cenu, ďalší po prvých testoch uvádzajú, že sa pri svojich úlohách radšej vracajú ku GPT-5.5. Objavili sa aj obavy z halucinácií, zatiaľ však prevažne na základe interpretácie jednotlivých benchmarkov a izolovaných skúseností. Nie je k dispozícii dostatok nezávislých testov, ktoré by potvrdili, že GPT-5.6 v bežnom používaní halucinuje viac než predchádzajúca generácia.

 

Časť počiatočného zmätku spôsobilo aj postupné sprístupňovanie. Niektorí používatelia videli GPT-5.6 v ChatGPT Work alebo Codexe skôr než v klasickom chate, prípadne mali rozdielnu dostupnosť medzi webovou aplikáciou, desktopovým Codexom a Codex CLI.
 

Ktorý model GPT-5.6 dáva najväčší zmysel

Sol je určený na úlohy, pri ktorých rozhoduje kvalita výsledku, schopnosť pracovať samostatne a zvládnutie komplexného zadania. Využitie nájde pri programovaní, výskume, rozsiahlej analýze, tvorbe prezentácií alebo agentických workflowoch.

 

Terra môže byť praktickejšou voľbou pre bežné produkčné nasadenie, kde je potrebná vysoká kvalita za nižšiu cenu. Luna je vhodná na jednoduchšie úlohy, subagentov, klasifikáciu, spracovanie veľkého objemu dát a aplikácie, v ktorých je prioritou rýchla odozva.

 

Počiatočné skúsenosti naznačujú, že najvýraznejšie rozdiely oproti GPT-5.5 sa prejavujú pri programovaní, práci s nástrojmi, vizuálnych výstupoch a dlhších úlohách s viacerými krokmi. Na spoľahlivé posúdenie bežného písania, faktickej presnosti a dlhodobej spotreby limitov bude potrebných viac nezávislých testov a skúseností z reálneho používania.

 

Pozrite si celú prezentáciu OpenAI:

Zdroj: YouTube OpenAI

Súvisiace články