Anthropic představil Claude Sonnet 5.5. Je efektivnější, rychlejší a mnohdy se vyrovná i Opusu 5.5

  • Anthropic představil Claude Sonnet 5.5, druhý model řady 5.5
  • V řadě testů se dotahuje na dvakrát dražší Opus 5.5
  • Stejnou práci má zvládnout rychleji a až o 30 % levněji než Sonnet 5

Sdílejte:
Adam Kurfürst
Adam Kurfürst
28.9.2026 22:35
Ikona komentáře 0
claude na hnedem pozadi ai ilustrace

Necelý týden po vydání Opusu 5.5 doplňuje Anthropic novou řadu o jeho levnějšího a rychlejšího sourozence. Claude Sonnet 5.5 míří na dobře vymezenou každodenní práci, jako je oprava chyb v kódu nebo tvorba dokumentů, prezentací a tabulek. Pokud Clauda používáte přes API, za tokeny zaplatíte stejně jako u Sonnetu 5, nový model jich ale na stejnou úlohu spotřebuje méně.

V testech mnohdy dorovnává Opus 5.5

Anthropic ve svém oznámení píše, že se model oproti předchůdci zlepšil ve všech oblastech, v některých dramaticky. Nejvýraznější skok hlásí z testu Terminal-Bench 4.0, který prověřuje složité úlohy v příkazové řádce. Sonnet 5.5 v něm podle tabulky firmy dosáhl na 70,6 %, zatímco Sonnet 5 jen na 10,3 %. Nad Opusem 5.5 se 66,4 % tu dokonce mírně vede.

V testu GDPval-AA, kde modely plní reálné pracovní úkoly ze 44 profesí, zaostává za Opusem 5.5 o pouhé dva body (1 844 proti 1 846) a Sonnet 5 přeskakuje zhruba o 400. Konkurenční GPT-6 Sol od OpenAI má v tabulce 1 487 bodů. Těsně za Opusem 5.5 zůstává nový model i v ovládání počítače a čtení grafů. Jako první Sonnet navíc dohrál Pokémon Red jen na základě snímků obrazovky. Firma i přes tohle všechno přiznává, že na složité a otevřené úlohy, které vyžadují dlouhodobý úsudek, je Opus 5.5 pořád zřetelně silnější, což je ale vzhledem k dlouhodobému vymezení modelových řad Claude logické.

claude sonnet 5.5 benchmarky

Nejvíc je zlepšení podle firmy znát při programování. V testu FrontierCode má Sonnet 5.5 při stejném nastavení o 10 bodů vyšší skóre než Sonnet 5 za zhruba patnáctinu nákladů. Testerům se líbilo, jak rychle se zorientuje v cizím kódu, a že častěji spojuje volání nástrojů dohromady, takže úlohu zvládne na méně kroků. Provozní ředitel Epic Games Daniel Vogel uvádí, že model zvládl desítky tisíc řádků kódu herní architektury i několikahodinové úlohy.

Firma vyzdvihuje i cit pro design. Nový Sonnet má dodávat vzhledu aplikací lepší vyladění a podle předlohy vytvořit prezentaci, kterou stačí jen málo upravit. V interním testu dostal čtvrtletní výsledky veřejně obchodované firmy spolu s přepisy hovorů s investory a měl podle šablony připravit prezentaci o deseti snímcích. Dva odborníci jeho první verzi označili za hotovou k odeslání.

Sonnet 5.5 je při stejné ceně mnohem efektivnější

Vývojáři zaplatí zhruba 43 Kč (2 dolary) za milion vstupních a 214 Kč (10 dolarů) za milion výstupních tokenů, tedy polovinu toho, co u Opusu 5.5. Čtení z mezipaměti vyjde na přibližně 4 Kč za milion tokenů. Úspora tedy nepramení z nižšího ceníku, ale z efektivity: model podle Anthropicu potřebuje na stejnou práci méně tokenů, a úloha tak vyjde až o 30 % levněji než se Sonnetem 5. Slack například u svého Slackbotu naměřil zhruba o 14 % méně výstupních tokenů.

Text navíc generuje o více než 30 % rychleji, což z něj dělá nejrychlejší Sonnet v historii. Rychlost a cenu si můžete vyvážit volbou úrovně úsilí. V aplikacích Claude a v Claude Code je výchozí střední úroveň, na vývojářské platformě vysoká. Právě se střední úrovní přitom Sonnet 5.5 v Terminal-Bench podle firmy výrazně překonal nejlepší výsledek Sonnetu 5, a to za méně než desetinu nákladů.

Model je dostupný už teď na všech platformách včetně cloudů Amazon Web Services, Google Cloud a Microsoft Azure, a to i v režimu bez uchovávání dat. Řadu 5.5 v příštích týdnech uzavře Haiku 5.5, určený pro levné nasazení ve velkém objemu.

Nový Sonnet poprvé dostal silnější bezpečnostní pojistky

Schopnosti v oblasti kybernetické bezpečnosti se podle Anthropicu vyrovnají Opusu 5, a tak jde o první Sonnet, který dostal podobné pojistky jako nejvýkonnější modely firmy. Hledat a opravovat chyby ve vlastním kódu půjde dál, rizikovější bezpečnostní úlohy ale viditelně přejdou na starší Sonnet 5. Ochrana v oblasti biologie zůstává stejná jako u předchůdce, podle firmy ale může omylem zachytit i některé dotazy z mikrobiologie a virologie.

Nově se Sonnet brání i takzvané destilaci, při které útočníci přes tisíce falešných účtů vysávají schopnosti modelu pro vlastní AI bez bezpečnostních omezení. Jako první Sonnet proto dostal klasifikátory, které brání vytěžování jeho uvažování. Přemýšlení modelu je nově svázané s účtem, který ho vytvořil, což pocítíte, pokud přenášíte konverzace mezi účty, třeba při přepnutí účtu uprostřed práce v Claude Code. V automatizovaném auditu chování s přibližně 1 850 scénáři si podle firmy vede stejně nebo lépe než Sonnet 5 a ze všech jejích modelů nejméně zkouší hranice prostředí, ve kterém běží.

Stačí vám na běžnou práci Sonnet 5.5, nebo si za Opus rádi připlatíte?

Zdroj: Anthropic

O autorovi

Adam Kurfürst

Adam studuje na gymnáziu a technologické žurnalistice se věnuje od svých 14 let. Pakliže pomineme jeho vášeň pro chytré telefony, tablety a příslušenství, rád se… Více o autorovi

Adam Kurfürst
Sdílejte: