GPT-6 Sol a Luna proti Opusu 5.5: testy a ceny
Ve FrontierCode má Opus 5.5 vyšší skóre. Luna má nejnižší náklady, Sol je mezi nimi. Porovnáváme také DeepSWE a ceny API ve třech grafech.
GPT-6 Sol a GPT-6 Luna přinášejí levnější provoz AI. Sol má základní sazby za vstup a výstup poloviční proti Claude Opus 5.5, Luna čtyřicetinové. V přímém srovnání programování ale dosahuje Opus vyššího skóre. Pro výběr modelu proto záleží na tom, jakou práci mu chcete svěřit.
OpenAI oba modely vydalo 22. září 2026. Níže porovnáváme zveřejněná měření Cognition, výsledky z oznámení OpenAI a ceník OpenAI s ceníkem Anthropic. Vlastní srovnávací test Chciweeeb jsme zatím neprováděli.
Stav zdrojů a cen: 22. září 2026. Skóre vždy patří uvedenému testu a nastavení.
Sol pro složitější práci, Luna pro menší úkoly ve velkém
GPT-6 Sol OpenAI zaměřuje na programování a práci agentů, kteří postupně používají nástroje a dokončují delší zadání. GPT-6 Luna míří na úzce vymezené úlohy ve velkém objemu. Oba přijímají text i obrázky a vytvářejí text.
Oba mají kontextové okno 1 050 000 tokenů a podporují nastavení přemýšlení od none po max. Výchozí je medium. Token je jednotka zpracovávaného obsahu, obvykle část slova. Samotná velikost kontextu neříká, jak dobře model vyřeší složitý úkol.
Podle oznámení OpenAI začíná dostupnost v ChatGPT Work a Codexu pro placené tarify Plus, Pro, Business, Enterprise a Edu. Free a Go dostávají Lunu v desktopové aplikaci. Zavádění probíhá postupně; v běžném Chatu zatím tyto modely nejsou. V API mají názvy gpt-6-sol a gpt-6-luna.
FrontierCode: Opus má vyšší skóre, Luna nižší náklady
Cognition ve FrontierCode srovnává všechny tři modely. Používáme verzi 1.1, část Main se 100 úlohami. Test hodnotí kvalitu změn v existujícím kódu, včetně požadavků, které by posuzoval správce projektu. Skóre není prosté procento kompletně vyřešených zakázek.
Zvětšit graf. Zdroj: FrontierCode 1.1 Main, skóre a náklady za jeden běh testu. Graf vybírá Medium a Max pro každý model.
Na Max získává Opus 5.5 skóre 54,4 %, Sol 49,3 % a Luna 42,4 %. Sol stojí v tomto nastavení přibližně třetinu nákladů Opusu, Luna zhruba šedesátinu. To jsou náklady na běh, nikoli cena za úspěšně dokončený úkol.
Zajímavější je Opus na Medium: 54,6 % za přibližně 0,80 USD. V této sadě má vyšší skóre a nižší náklady než Sol na Max. Ani u Opusu samotného tedy dražší Max nepřinesl lepší výsledek. Rozdíl 0,2 procentního bodu mezi jeho nastaveními ale nestačí k závěru, že Medium je obecně schopnější.
GPT zde běží v Codexu, Opus v Claude Code. Srovnáváme tak modely společně s jejich pracovním prostředím. Stejný název úrovně přemýšlení také neznamená stejnou spotřebu výpočtu u různých výrobců.
DeepSWE: Sol a Luna jsou si v tomto testu blíž
V měřeních zveřejněných OpenAI má Sol na Max v DeepSWE 1.1 skóre 68,8 % a Luna 66,6 %. Rozdíl je 2,2 procentního bodu. DeepSWE používá původní, delší programátorské úlohy v existujících projektech.
Zvětšit graf. Zdroj: oznámení GPT-6 Sol a Luna. Jde o výsledky publikované výrobcem modelů.
OpenAI v tomto srovnání uvádí starší Opus 5 a Fable 5, nikoli Opus 5.5. Chybějící výsledek proto nedoplňujeme. Ani procenta z DeepSWE nelze postavit proti procentům z FrontierCode: každý test má jiné úlohy a způsob hodnocení.
V době kontroly ještě CursorBench 4.0 ani Artificial Analysis nové Sol a Lunu ve veřejných tabulkách neuváděly. Výsledky GPT-5.6 pod podobnými názvy patří předchozí generaci.
Ceny API: Sol za polovinu Opusu, Luna za čtyřicetinu
Následující sazby platí za milion tokenů ve standardním přímém API. U GPT počítáme s požadavky do 272 000 vstupních tokenů. Nejde o měsíční předplatné ChatGPT, Codexu ani Claude.
Zvětšit graf. Zdroje: OpenAI API a Claude API.
USD / milion tokenů | GPT-6 Sol | GPT-6 Luna | Opus 5.5 |
|---|---|---|---|
Vstup bez cache | 2 | 0,10 | 4 |
Výstup | 10 | 0,50 | 20 |
Čtení z cache | 0,20 | 0,01 | 0,20 |
Rozdíl je v opakovaném čtení podkladů z cache: Sol a Opus 5.5 mají shodnou sazbu 0,20 USD. Zápis do cache se účtuje zvlášť. U GPT nad hranicí 272 000 vstupních tokenů platí pro celý požadavek dvojnásobná vstupní sazba a 1,5násobná výstupní sazba. Regionální zpracování a jiné režimy mají další pravidla.
Model s levnějšími tokeny může potřebovat více kroků nebo oprav. Právě proto může Opus na Medium ve FrontierCode vyjít levněji než Sol na Max, přestože jeho základní vstupní a výstupní sazby jsou vyšší.
Co bychom zkusili při práci na webu
Pro větší zásah do aplikace bychom podle těchto dat začali porovnáním Solu a Opusu na Medium. Zadání má zahrnout dokončení změny i její ověření. Například u redesignu webu by agent měl upravit stránku, zachovat odkazy a zkontrolovat zobrazení na telefonu. Samotné hezké zpracování úvodní obrazovky k převzetí práce nestačí.
Lunu bychom zkusili na levné, opakované úlohy s jasnou kontrolou výsledku. Třeba převod dodaných podkladů do pevné struktury nebo menší úpravy obsahu firemního webu. Její cena umožňuje zpracovat větší objem, ale nenahrazuje kontrolu správnosti.
Úvodní a tato doprovodná ilustrace vznikly pomocí AI. Datové grafy jsme vykreslili z uvedených čísel.
Při porovnání bychom zapisovali cenu celého běhu, čas do hotového výsledku a počet nutných oprav. Úkol končí až ve chvíli, kdy funguje ve sjednaném rozsahu. To je pro rozpočet webu užitečnější údaj než cena milionu tokenů.
Zdroje a další čtení
- OpenAI: vydání GPT-6 Sol a Luna, benchmarky a dostupnost
- OpenAI API: changelog z 22. září 2026
- OpenAI API: parametry GPT-6 Sol
- OpenAI API: parametry GPT-6 Luna
- Cognition: aktuální FrontierCode 1.1 Main
- Cognition: metodika FrontierCode 1.1
- Datacurve: DeepSWE a popis úloh
- OpenAI API: aktuální sazby tokenů a cache
- Claude API: aktuální sazby tokenů a cache
- CursorBench 4.0: kontrola dostupných modelů
- Artificial Analysis: kontrola dostupných modelů
Komentáře
Načítání komentářů…