Claude Sonnet 5.5 vs. Opus, Sol a Astra: kolik stojí úloha
Sonnet 5.5 na Max stojí v testech Artificial Analysis víc než Opus i GPT-6 Astra. Srovnání ceny za úlohu, spotřeby tokenů a nastavení Xhigh a Max.
Sonnet 5.5 na Max za úsporný model nepovažuji. V měření Artificial Analysis stojí jedna úloha víc než u Opusu 5.5 i GPT-6 Astra, přestože má Sonnet levnější výstupní tokeny. Vysoká spotřeba cenovou výhodu smaže.
Nový Sonnet vyšel 28. září 2026. Níže srovnávám zveřejněná data k tomuto dni. Úvodní screenshot pochází z Artificial Analysis, varianty Max s výchozím fallbackem.
Za úlohu zaplatíte víc než u Opusu
Graf používá cenu za úlohu v Artificial Analysis Intelligence Indexu v4.3.2. Jde o vážený průměr napříč testy, který zahrnuje vstup, výstup i cache. Není to cena za úspěšně dokončený úkol ani odhad ceny celého webu. Všechny čtyři modely tu mají nastavení Max; u Claude AA uvádí varianty s výchozím fallbackem.
| Claude Sonnet 5.5 | 7,60 USD | Max · index 56,0 |
|---|---|---|
| Claude Opus 5.5 | 5,98 USD | Max · index 57,6 |
| GPT-6 Astra | 3,26 USD | Max · index 52,7 |
| GPT-6 Sol | 1,06 USD | Max · index 47,5 |
Zdroj: Artificial Analysis
Sonnet na Max stojí víc než Opus na Max a současně dosahuje nižšího souhrnného skóre.
Sol má v této sestavě nejnižší cenu i skóre. Astra vychází levněji než oba modely Claude. To je užitečnější srovnání než samotný ceník tokenů, ale konkrétní úlohy mohou pořadí změnit. Jak se s náklady pracuje v aplikaci, rozebírám v článku o předplatném a API.
Xhigh a Max u všech čtyř modelů
Stejné označení úrovně nezaručuje stejnou výpočetní náročnost. Tabulka ukazuje, co přechod z Xhigh na Max udělal se skóre a cenou každého modelu. Skóre je zaokrouhlené na desetinu bodu; malé rozdíly nejsou jistým náskokem.
Model | Index | USD za úlohu |
|---|---|---|
Claude Sonnet 5.5 | 51,9 → 56,0 | 2,74 → 7,60 |
Claude Opus 5.5 | 56,0 → 57,6 | 3,46 → 5,98 |
GPT-6 Sol | 44,1 → 47,5 | 0,53 → 1,06 |
GPT-6 Astra | 52,4 → 52,7 | 2,31 → 3,26 |
Opus na Xhigh dosahuje prakticky stejného indexu jako Sonnet na Max za méně než polovinu ceny úlohy.
U Sonnetu přechod na Max znamená přibližně 2,8násobnou cenu za zhruba čtyři body indexu navíc. Xhigh proto vychází podstatně střídměji. Rozdíl mezi úrovněmi podrobněji rozebírají i články o Opusu 5.5 a GPT-6 Astra.
Artificial Analysis: srovnání Sonnetu Max a Xhigh, 28. 9. 2026. Výřez exportu původní tabulky. Kliknutím obrázek otevřete ve větším rozlišení.
Spotřeba tokenů rozdíl vysvětluje
Výstupní tokeny v grafu zahrnují odpověď i přemýšlení. Opět jde o vážený průměr na úlohu ve stejném indexu. Vedle výsledku na Max je pro srovnání uvedený výstup na Xhigh.
| Claude Sonnet 5.5 | 192,8 | Xhigh: 73,7 tis. |
|---|---|---|
| Claude Opus 5.5 | 119,2 | Xhigh: 65,7 tis. |
| GPT-6 Sol | 31,2 | Xhigh: 16,0 tis. |
| GPT-6 Astra | 27,2 | Xhigh: 16,9 tis. |
Zdroj: Artificial Analysis
Sonnet na Max produkuje nejvíc výstupních tokenů z této čtveřice; proti vlastnímu Xhigh jeho spotřeba vzroste přibližně 2,6×.
Účet navíc nekončí u výstupu. V rozpisu AA je u Sonnetu na Max největší položkou čtení cache. Opakované zpracování kontextu tak stojí víc než samotné generování. Částka za úlohu počítá i s typickou úspěšností cache podle metodiky AA.
V těchto testech Sonnet na Max s tokeny nehospodaří dobře. To ale automaticky nepopisuje jeho nižší nastavení ani každé zadání. Pro rozhodnutí o výměně modelu je potřeba sledovat cenu i kvalitu stejné práce.
V programování Max nemusí vyhrát
Také programátorské testy zveřejněné Anthropic ukazují rozdílný přínos Max. Následující tabulka porovnává pouze Sonnet 5.5; skóre mezi různými benchmarky nesčítám.
Test Sonnetu 5.5 | Xhigh | Max |
|---|---|---|
FrontierCode 1.1 Main | 52,1 % | 46,2 % |
CursorBench 4.0 | 53,1 % | 55,5 % |
Zdroj: Anthropic; vyšší skóre je lepší.
V CursorBench vyšší nastavení pomohlo, ve FrontierCode výsledek zhoršilo.
Anthropic pokles ve FrontierCode spojuje s kontrolou kódu, která v prozkoumaných případech vedla k překročení času nebo rozsahu zadání. Max bych proto nezapínal automaticky. Začněte na Xhigh nebo nižší úrovni a na stejném zadání porovnejte účet, funkčnost a čas vlastní kontroly. Připlácet má smysl za lepší výsledek.
Zdroje a další čtení
Nové články e-mailem
Když vyjde nový článek, pošleme vám krátký e-mail s odkazem na něj.
Komentáře
Načítání komentářů…