Vlajková kvalita pro každodenní práci
Do Ayeto jsme přidali Claude Opus 5.5, první model nové řady Claude 5.5 od Anthropicu. Podle Anthropicu ve většině práce dosahuje úrovně Claude Fable 5.1, jeho provoz vyjde zhruba o 40 % levněji než u Opus 5 a odpovědi generuje o více než 30 % rychleji.
V praxi to znamená model, který zvládne dlouhé programátorské úlohy, výzkum i práci s dokumenty, na které jste dosud potřebovali Fable, a to za cenu mnohem bližší běžnému používání.
Co je Claude Opus 5.5?
Claude Opus 5.5 je vlajkový model Anthropicu pro náročnou odbornou práci, agentní programování a dlouhotrvající samostatné úlohy. Přijímá text i obrázky, pracuje s nástroji a podporuje úroveň uvažování od low po max.
Anthropic zdůrazňuje i srozumitelnější komunikaci: Opus 5.5 dává to nejdůležitější na začátek odpovědi, takže se i delší odpovědi snadno čtou.
Jak si stojí ve srovnání
| Benchmark | Opus 5.5 | Fable 5.1 | Opus 5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 66,4 % | 55,8 % | 52,3 % |
| CursorBench 4.0 | 57,8 % | 51,8 % | 46,6 % |
| FrontierCode v1.1 | 54,4 % | 50,3 % | 48,0 % |
| GDPval-AA v2.1 (Elo) | 1846 | 1735 | 1708 |
| AutomationBench | 40,0 % | 31,4 % | 26,9 % |
| Humanity's Last Exam (s nástroji) | 67,7 % | 65,6 % | 63,6 % |
Programování a práce v terminálu
V Terminal-Bench 4.0 dosahuje Opus 5.5 66,4 %, tedy víc než Fable 5.1 i Opus 5. Podle Anthropicu při střední úrovni uvažování dosáhne toho, co Opus 5 zvládl jen na maximální úrovni, takže mnoho úloh dokončí s menším počtem tokenů.
Odborná práce
V GDPval-AA, který měří profesní úlohy jako analýzy, reporty a prezentace, vede Opus 5.5 s 1846 body Elo. Hodí se proto pro výzkum, psaní dokumentů a zpracování velkého množství podkladů.
Bezpečnost
V automatizovaném behaviorálním auditu Anthropicu vychází Opus 5.5 jako nejlepší model, jaký firma testovala. O 85 % méně často než Opus 5 se pokoušel obejít omezení svého prostředí a v odolnosti vůči prompt injection se vyrovná Fable 5.1. To je důležité všude, kde asistent čte webové stránky, e-maily nebo dokumenty.
Dvě varianty v Ayeto
V Ayeto najdete Claude Opus 5.5 a Claude Opus 5.5 (High). Standardní varianta je vhodnou výchozí volbou pro většinu práce. Varianta High věnuje každému požadavku víc uvažování a hodí se na nejtěžší úlohy: složité ladění, větší refaktoring nebo analýzy, kde je přesnost důležitější než rychlost.
Kdy v Ayeto zvolit Opus 5.5
Opus 5.5 zvolte pro dlouhé agentní úlohy, práci s kódem a repozitáři, výzkum z mnoha zdrojů a dokumenty, které musí být přesné a dobře strukturované. Pokud jste na takovou práci dosud používali Fable 5.1, vyplatí se Opus 5.5 vyzkoušet jako levnější alternativu.
Na krátké odpovědi, jednoduché přepisy nebo klasifikaci vyjde úsporněji lehčí model. V Ayeto můžete model v nastavení asistenta přepnout, aniž byste měnili zbytek jeho nastavení.
Jak je to s cenou
Za token je Opus 5.5 o 20 % levnější než Opus 5 a čtení z mezipaměti promptu vyjde o 60 % levněji. Protože navíc potřebuje k dokončení úlohy méně tokenů, odhaduje Anthropic celkové náklady běžné zátěže zhruba o 40 % níž než u Opus 5.
Ayeto převádí využití na kredity. Nejspolehlivější je pustit stejnou reálnou úlohu přes Opus 5.5, Opus 5 a Fable 5.1 v Porovnání modelů Ayeto a porovnat kvalitu, dobu zpracování a celkovou spotřebu kreditů.
Vyzkoušejte Claude Opus 5.5
Claude Opus 5.5 je teď dostupný v Ayeto. Vyberte ho v nastavení asistenta nebo přímo v chatu a dejte mu úlohu, kterou byste jinak svěřili svému nejsilnějšímu modelu.