Přeskočit na obsah
Vývoj webů

Claude Sonnet 5.5 vs. Opus, Sol a Astra: kolik stojí úloha

Sonnet 5.5 na Max stojí v testech Artificial Analysis víc než Opus i GPT-6 Astra. Srovnání ceny za úlohu, spotřeby tokenů a nastavení Xhigh a Max.

Maxim KudelaZobrazení se souhlasem: 0
Screenshot Artificial Analysis: Sonnet 5.5 na Max, index 56 a cena 7,60 USD za úlohu. Zachyceno 28. září 2026.

Sonnet 5.5 na Max za úsporný model nepovažuji. V měření Artificial Analysis stojí jedna úloha víc než u Opusu 5.5 i GPT-6 Astra, přestože má Sonnet levnější výstupní tokeny. Vysoká spotřeba cenovou výhodu smaže.

Nový Sonnet vyšel 28. září 2026. Níže srovnávám zveřejněná data k tomuto dni. Úvodní screenshot pochází z Artificial Analysis, varianty Max s výchozím fallbackem.

Za úlohu zaplatíte víc než u Opusu

Graf používá cenu za úlohu v Artificial Analysis Intelligence Indexu v4.3.2. Jde o vážený průměr napříč testy, který zahrnuje vstup, výstup i cache. Není to cena za úspěšně dokončený úkol ani odhad ceny celého webu. Všechny čtyři modely tu mají nastavení Max; u Claude AA uvádí varianty s výchozím fallbackem.

Cena úlohy v AA Intelligence Indexu: Max, USD, méně je lépe
Claude Sonnet 5.57,60 USDMax · index 56,0
Claude Opus 5.55,98 USDMax · index 57,6
GPT-6 Astra3,26 USDMax · index 52,7
GPT-6 Sol1,06 USDMax · index 47,5

Zdroj: Artificial Analysis

Sonnet na Max stojí víc než Opus na Max a současně dosahuje nižšího souhrnného skóre.

Sol má v této sestavě nejnižší cenu i skóre. Astra vychází levněji než oba modely Claude. To je užitečnější srovnání než samotný ceník tokenů, ale konkrétní úlohy mohou pořadí změnit. Jak se s náklady pracuje v aplikaci, rozebírám v článku o předplatném a API.

Xhigh a Max u všech čtyř modelů

Stejné označení úrovně nezaručuje stejnou výpočetní náročnost. Tabulka ukazuje, co přechod z Xhigh na Max udělal se skóre a cenou každého modelu. Skóre je zaokrouhlené na desetinu bodu; malé rozdíly nejsou jistým náskokem.

Model

Index
Xhigh → Max

USD za úlohu
Xhigh → Max

Claude Sonnet 5.5

51,9 → 56,0

2,74 → 7,60

Claude Opus 5.5

56,0 → 57,6

3,46 → 5,98

GPT-6 Sol

44,1 → 47,5

0,53 → 1,06

GPT-6 Astra

52,4 → 52,7

2,31 → 3,26

Opus na Xhigh dosahuje prakticky stejného indexu jako Sonnet na Max za méně než polovinu ceny úlohy.

U Sonnetu přechod na Max znamená přibližně 2,8násobnou cenu za zhruba čtyři body indexu navíc. Xhigh proto vychází podstatně střídměji. Rozdíl mezi úrovněmi podrobněji rozebírají i články o Opusu 5.5 a GPT-6 Astra.

Srovnání Sonnetu 5.5 Max a Xhigh z Artificial Analysis: cena 7,60 a 2,74 USD za úlohu, výstup 193 a 74 tisíc tokenů.

Artificial Analysis: srovnání Sonnetu Max a Xhigh, 28. 9. 2026. Výřez exportu původní tabulky. Kliknutím obrázek otevřete ve větším rozlišení.

Spotřeba tokenů rozdíl vysvětluje

Výstupní tokeny v grafu zahrnují odpověď i přemýšlení. Opět jde o vážený průměr na úlohu ve stejném indexu. Vedle výsledku na Max je pro srovnání uvedený výstup na Xhigh.

Výstupní tokeny na úlohu: Max, v tisících, méně je lépe
Claude Sonnet 5.5192,8Xhigh: 73,7 tis.
Claude Opus 5.5119,2Xhigh: 65,7 tis.
GPT-6 Sol31,2Xhigh: 16,0 tis.
GPT-6 Astra27,2Xhigh: 16,9 tis.

Zdroj: Artificial Analysis

Sonnet na Max produkuje nejvíc výstupních tokenů z této čtveřice; proti vlastnímu Xhigh jeho spotřeba vzroste přibližně 2,6×.

Účet navíc nekončí u výstupu. V rozpisu AA je u Sonnetu na Max největší položkou čtení cache. Opakované zpracování kontextu tak stojí víc než samotné generování. Částka za úlohu počítá i s typickou úspěšností cache podle metodiky AA.

V těchto testech Sonnet na Max s tokeny nehospodaří dobře. To ale automaticky nepopisuje jeho nižší nastavení ani každé zadání. Pro rozhodnutí o výměně modelu je potřeba sledovat cenu i kvalitu stejné práce.

V programování Max nemusí vyhrát

Také programátorské testy zveřejněné Anthropic ukazují rozdílný přínos Max. Následující tabulka porovnává pouze Sonnet 5.5; skóre mezi různými benchmarky nesčítám.

Test Sonnetu 5.5

Xhigh

Max

FrontierCode 1.1 Main

52,1 %

46,2 %

CursorBench 4.0

53,1 %

55,5 %

Zdroj: Anthropic; vyšší skóre je lepší.

V CursorBench vyšší nastavení pomohlo, ve FrontierCode výsledek zhoršilo.

Anthropic pokles ve FrontierCode spojuje s kontrolou kódu, která v prozkoumaných případech vedla k překročení času nebo rozsahu zadání. Max bych proto nezapínal automaticky. Začněte na Xhigh nebo nižší úrovni a na stejném zadání porovnejte účet, funkčnost a čas vlastní kontroly. Připlácet má smysl za lepší výsledek.

Zdroje a další čtení

Nové články e-mailem

Když vyjde nový článek, pošleme vám krátký e-mail s odkazem na něj.

Odběr potvrdíte v e-mailu, který vám pošleme. Odhlásit se můžete v každém e-mailu. Ochrana osobních údajů.

Komentáře

Načítání komentářů…

Pište k tématu a bez osobních údajů. Komentáře před zveřejněním kontrolujeme, i s pomocí AI. Jméno a text schváleného komentáře budou veřejné. Ochrana osobních údajů