Dňa 24. júla 2026 Anthropic sprístupnil Claude Opus 5, nový model najvyššej triedy Opus, určený predovšetkým na zložité agentné programovanie, dlhé viacstupňové procesy a náročnú enterprise prácu.[1]
Oficiálny názov modelu je Claude Opus 5, nie „Claude Opus 5.0“. Identifikátor používaný v API je:
claude-opus-5
Opus 5 nenahrádza Claude Fable 5 ako najvýkonnejší verejne dostupný model Anthropic. Výrobca ho skôr predstavuje ako model, ktorý sa približuje schopnostiam Fable 5 pri nižšej cene a miernej, nie najpomalšej, latencii.[2]
Pre používateľov Opus 4.8 je najdôležitejšie, že základná cena sa nezvýšila:
- 5 USD za milión vstupných tokenov,
- 25 USD za milión výstupných tokenov.[3]
Opus 5 zároveň prináša adaptívny reasoning zapnutý v predvolenom nastavení, novú najvyššiu úroveň effort max, kontext až jeden milión tokenov, štandardný maximálny výstup 128 000 tokenov a nové mechanizmy pre dlho bežiacich agentov.[2][4]
Najkratší záver: Claude Opus 5 je predovšetkým veľká aktualizácia pre tímy, ktoré modelu zadávajú celé úlohy, nie iba jednotlivé fragmenty kódu. Migrácia však nepomôže každej aplikácii, pretože Sonnet 5 zostáva výrazne lacnejší a Fable 5 si zachováva najvyššiu pozíciu ponuky z pohľadu maximálnych schopností.
Informácie a dokumentácia boli overené 24. júla 2026.
TL;DR
| Otázka | Odpoveď |
|---|---|
| Kedy bol model uvedený? | 24. júla 2026 |
| Aký je oficiálny názov? | Claude Opus 5 |
| Aký je identifikátor API? | claude-opus-5 |
| Koľko stojí? | 5 USD / MTok vstupu a 25 USD / MTok výstupu |
| Zvýšila sa cena oproti Opus 4.8? | Nie |
| Aký veľký je kontext? | 1 milión tokenov |
| Aký je štandardný maximálny výstup? | 128 000 tokenov |
| Je reasoning štandardne zapnutý? | Áno |
| Aké úrovne effort podporuje? | low, medium, high, xhigh, max |
| Nahrádza Fable 5 ako najsilnejší model? | Nie |
| Mizne Opus 4.8? | Nie, zostáva dostupný |
| Kde je dostupný? | Claude, Claude Code, API, AWS, Google Cloud a Microsoft Foundry |
| Existuje Fast mode? | Áno, ako research preview |
| Sú všetky benchmarky nezávislé? | Nie, väčšina výsledkov pri uvedení pochádza od Anthropic alebo partnerov |
1. Čo je Claude Opus 5?
Anthropic opisuje Opus 5 ako model pre:
- zložité agentné programovanie,
- prácu s veľkými repozitármi,
- dlhé cykly používania nástrojov,
- riešenie viacstupňových problémov,
- analýzu dokumentov a dát,
- kancelársku prácu,
- koordináciu viacerých agentov,
- vytváranie a zlepšovanie rozhraní a vizuálnych materiálov.[4]
Opus 5 sa nachádza medzi Sonnet 5 a Fable 5:
Sonnet 5
Rýchlejší a lacnejší model pre prácu vo veľkom rozsahu
Opus 5
Model pre ťažké agentné a enterprise úlohy
Fable 5
Najvyššia verejne dostupná schopnosť Anthropic
Anthropic odporúča začať s Opus 5 pri zložitom agentnom programovaní a enterprise práci. Fable 5 má byť voľbou vtedy, keď je potrebná najvyššia dostupná schopnosť bez ohľadu na vyššiu cenu.[2]
2. Najdôležitejšie technické parametre
| Parameter | Claude Opus 5 |
|---|---|
| API ID | claude-opus-5 |
| Kontext | 1 000 000 tokenov |
| Štandardný maximálny výstup | 128 000 tokenov |
| Reasoning | Adaptívny, predvolene zapnutý |
| Úrovne effort | low, medium, high, xhigh, max |
| Cena vstupu | 5 USD / MTok |
| Cena výstupu | 25 USD / MTok |
| Cena Batch API | 2,50 USD / MTok vstupu, 12,50 USD / MTok výstupu |
| Fast mode | 10 USD / MTok vstupu, 50 USD / MTok výstupu |
| Reliable knowledge cutoff | máj 2026 |
| Training data cutoff | máj 2026 |
| Obrázok ako vstup | áno |
| Text ako výstup | áno |
Údaje o kontexte, cenách a dátumoch cutoff pochádzajú z oficiálneho prehľadu modelov a cenníka Anthropic.[2][3]
Jeden milión tokenov je predvolená hodnota
Pri Opus 5 je kontext jedného milióna tokenov súčasne predvolenou aj maximálnou hodnotou. Neexistuje samostatná verzia s menším kontextom.[4]
Neznamená to, že každá informácia z veľmi dlhého promptu bude použitá s rovnakou presnosťou. Maximálna kapacita nezaručuje dokonalé vyhľadávanie, reasoning ani zapamätanie každého detailu.
Štandardný výstup až 128 000 tokenov
Štandardné volania Messages API môžu vygenerovať až 128 000 tokenov. Anthropic dokumentuje aj experimentálny výstup až 300 000 tokenov pre Message Batches API s príslušným beta headerom.[5]
Je určený napríklad pre:
- veľmi dlhú dokumentáciu,
- rozsiahlu extrakciu dát,
- veľké kostry kódu,
- koncepty v rozsahu knihy,
- dlhé reasoning procesy.
Generovanie takto veľkej odpovede môže trvať viac ako hodinu a nie je dostupné v bežnom synchrónnom Messages API.[5]
3. Thinking je teraz predvolene zapnutý
Ide o jednu z najdôležitejších zmien pri migrácii.
V Opus 4.8 fungoval request bez poľa thinking bez dodatočného reasoningu. V Opus 5 ten istý request spustí adaptívny reasoning. Model sám rozhoduje, kedy a ako dlho má problém analyzovať.[4]
Základné volanie môže vyzerať takto:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-opus-5",
max_tokens=16_000,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Analyzuj architektúru projektu a navrhni plán migrácie."
}
],
)
print(response.content)
Nie je potrebné pridávať:
thinking={"type": "adaptive"}
pretože ide o predvolené správanie. Explicitné nastavenie zostáva podporované.
Päť úrovní effort
Opus 5 podporuje:
low
medium
high
xhigh
max
max je najvyššia úroveň test-time compute a nevyžaduje beta header.[4]
Vyšší effort môže pri ťažkých úlohách zvýšiť kvalitu, ale zvyčajne znamená aj:
- vyššiu spotrebu tokenov,
- vyššie náklady,
- dlhšie čakanie,
- viac operácií s nástrojmi,
- dlhšiu prácu subagentov.
Preto by sa max nemal automaticky používať pre každý request.
4. Kedy možno thinking vypnúť?
Opus 5 umožňuje vypnúť thinking iba pri effort:
low,medium,high.
Kombinácia:
{
"thinking": {"type": "disabled"},
"output_config": {"effort": "xhigh"}
}
alebo:
{
"thinking": {"type": "disabled"},
"output_config": {"effort": "max"}
}
vráti HTTP 400.[4]
Ide o nekompatibilnú zmenu oproti Opus 4.8.
Anthropic tiež upozorňuje, že pri vypnutom thinking môže Opus 5 občas:
- zapísať volanie nástroja ako bežný text namiesto bloku
tool_use, - vložiť do viditeľnej odpovede interné XML značky.
Anthropic odporúča nechať thinking zapnutý a kontrolovať náklady nižším effort, pokiaľ integrácia nevyžaduje iné správanie.[4]
5. Čo sa skutočne zlepšilo oproti Opus 4.8?
Podľa dokumentácie Anthropic sa najväčšie zmeny týkajú:
- hlbokého reasoningu,
- agentného programovania,
- dlhotrvajúcich úloh,
- rastu kvality s effort,
- code review a hľadania chýb,
- vizuálnej analýzy,
- práce s dlhým kontextom,
- dokumentov, tabuliek a prezentácií,
- koordinácie viacerých agentov.[4]
Dlhšie úlohy a menej nedokončenej práce
Anthropic uvádza, že Opus 5 lepšie udržuje cieľ počas dlhých cyklov nástrojov a častejšie dokončuje:
- funkcie rozložené do viacerých súborov,
- veľké refaktoringy,
- end-to-end úlohy,
- prácu vyžadujúcu testovanie a overenie.
Výrobca zdôrazňuje menej placeholderov a nedokončených fragmentov.[4]
Automatické overovanie
Opus 5 častejšie kontroluje vlastné výsledky. Migračná dokumentácia dokonca odporúča odstrániť opakované pokyny typu:
Na konci svoju prácu určite skontroluj.
Použi samostatného subagenta na kontrolu.
Ich zachovanie môže viesť k nadmernému overovaniu, ďalším volaniam nástrojov a zbytočným nákladom.[4]
Viac delegovania subagentom
V multi-agentných prostrediach model častejšie rozdeľuje a deleguje úlohy. To môže byť prínosné, ale vyžaduje:
- rozpočtové limity,
- sledovanie počtu volaní,
- kontrolu oprávnení nástrojov,
- ochranu pred súčasnou úpravou rovnakých súborov.
6. Benchmarky: čo oznámil Anthropic?
Pri uvedení Anthropic oznámil najlepšie výsledky Opus 5 v programovaní a knowledge work, okrem iného vo Frontier-Bench a GDPval-AA.[1]
Je potrebné zachovať správny kontext:
- časť testov je interná,
- konfiguráciu a harness vybral výrobca alebo partner,
- výsledky môžu závisieť od effort,
- cena za úlohu závisí od spotreby tokenov,
- nie každý benchmark má verejný a ľahko reprodukovateľný dataset,
- nejde o nezávislé certifikácie kvality.
Frontier-Bench v0.1
Anthropic tvrdí, že Opus 5:
- je prvý vo Frontier-Bench v0.1,
- získava viac ako dvojnásobný výsledok oproti Opus 4.8,
- pri nižšej cene za úlohu.[1]
V poznámke uvádza, že išlo o interný run s harness mini-SWE-agent, backendom GKE a priemerom piatich pokusov na úlohu. Pri odmietnutí safety classifieru sa použil Opus 4.8 ako fallback.[1]
Toto metodické obmedzenie musí byť uvedené spolu s výsledkom.
CursorBench 3.2
Pri effort max mal Opus 5 skončiť 0,5 percentuálneho bodu od najlepšieho výsledku Fable 5 približne za polovicu ceny na úlohu.[1]
Je to užitočné na hodnotenie pomeru cena-kvalita, ale ide o test publikovaný Anthropic a partnerom, nie nezávislou inštitúciou.
ARC-AGI 3
Anthropic uvádza výsledok približne trikrát vyšší než ďalší model v tabuľke.[1]
Neznamená to „trikrát inteligentnejší“. Benchmark meria špecifický typ riešenia nových problémov, nie všeobecnú inteligenciu.
Zapier AutomationBench
Podľa Anthropic bola úspešnosť Opus 5 približne 1,5-krát vyššia než pri ďalšom modeli za podobnú cenu. Aj najnižší effort mal prejsť viac úloh než ostatné modely.[1]
OSWorld 2.0
V benchmarku ovládania počítača mal Opus 5 dosiahnuť najlepší pomer výkon-cena a prekonať najlepší výsledok Fable 5 za niečo viac než tretinu nákladov.[1]
Vedecký výskum
Anthropic uvádza zlepšenie oproti Opus 4.8 vo všetkých vlastných life-sciences evaluáciách, vrátane:
- o 10,2 percentuálneho bodu v internom teste odvodzovania molekulárnych štruktúr zo spektroskopických dát,
- o 7,7 bodu v úlohách predpovedajúcich funkčný dopad zmien proteínových sekvencií.[1]
Ide o interné výsledky výrobcu, nie nezávislú klinickú alebo vedeckú validáciu.
7. Opus 5 vs Opus 4.8
| Vlastnosť | Opus 4.8 | Opus 5 |
|---|---|---|
| Základná cena | 5 / 25 USD za MTok | 5 / 25 USD za MTok |
| Kontext | až 1M tokenov | štandardne 1M |
| Maximálny výstup | 128k | 128k |
| Thinking bez konfigurácie | vypnutý | adaptívne zapnutý |
| Najvyšší effort | nižší rozsah | max |
| Minimálna dĺžka prompt cache | 1 024 tokenov | 512 tokenov |
| Zmeny nástrojov počas konverzácie | bez novej funkcie | beta |
| Automatický fallback podľa odmietnutia | bez nového režimu | beta |
| Cena Fast mode | 10 / 50 USD | 10 / 50 USD |
| Stav | stále aktívny | najnovší Opus |
Opus 4.8 nebol vyradený. Podľa oficiálneho harmonogramu zostávajú oba modely aktívne a Opus 5 nemá byť vyradený pred 24. júlom 2027.[6]
Kedy zostať pri Opus 4.8?
Môže to dávať zmysel, keď:
- existujúci prompt a agent sú presne vyladené,
- tím nedokončil regresné testy,
- aplikácia očakáva thinking vypnutý bez explicitnej konfigurácie,
- proces vyžaduje stabilný známy štýl odpovede,
- klasifikátory Opus 5 blokujú legitímne cybersecurity workflow,
- migrácia neprináša merateľné zlepšenie kvality.
8. Opus 5 vs Sonnet 5
| Vlastnosť | Sonnet 5 | Opus 5 |
|---|---|---|
| Profil | rýchlosť a inteligencia vo veľkom rozsahu | ťažké agentné a enterprise úlohy |
| Štandardná cena | 3 / 15 USD za MTok | 5 / 25 USD za MTok |
| Akciová cena Sonnet | 2 / 10 USD do 31. augusta 2026 | bez obdobnej akcie |
| Kontext | 1M | 1M |
| Maximálny výstup | 128k | 128k |
| Thinking | adaptívny | adaptívny |
| Latencia podľa Anthropic | rýchla | mierna |
| Najvyšší effort | nižší než plná škála Opus | max |
Sonnet 5 je vhodnejší pre:
- vysokú prevádzku,
- časté krátke úlohy,
- automatizáciu s prioritou nákladov,
- štandardné generovanie kódu,
- klasifikáciu a extrakciu,
- aplikácie vyžadujúce nižšiu latenciu.
Opus 5 má väčší zmysel, keď chybná alebo nedokončená úloha stojí viac než dodatočné tokeny.
9. Opus 5 vs Fable 5
| Vlastnosť | Opus 5 | Fable 5 |
|---|---|---|
| Pozícia | ťažký agentic coding a enterprise | najvyššia verejne dostupná schopnosť |
| Cena | 5 / 25 USD | 10 / 50 USD |
| Kontext | 1M | 1M |
| Maximálny výstup | 128k | 128k |
| Latencia podľa Anthropic | mierna | pomalšia |
| Thinking | adaptívny | vždy zapnutý |
| Požiadavka na retenciu dát | bez osobitnej požiadavky pri bežnom prístupe | 30 dní v API |
| Cyber ochrany | menej reštriktívne | výrazne silnejšie klasifikátory |
Anthropic predstavuje Opus 5 ako model, ktorý sa približuje Fable 5 za polovicu ceny.[1]
Neznamená to, že Opus 5 vždy dosahuje rovnakú úroveň. Oficiálny prehľad stále uvádza Fable 5 ako najvýkonnejší široko dostupný model Anthropic.[2]
Kde môže byť Opus 5 praktickejší?
- každodenné programovanie,
- code review,
- veľké refaktoringy,
- enterprise workflow,
- analýza dokumentov,
- legitímna cybersecurity práca s menším počtom odmietnutí,
- situácie, keď je Fable príliš drahý.
10. Novinky pre agentov a API
Zmena nástrojov počas konverzácie
V beta režime možno medzi turns pridávať alebo odoberať nástroje bez zneplatnenia prompt cache.[4]
Požadovaný header:
mid-conversation-tool-changes-2026-07-01
Je užitočný, keď agent:
- začne analytickými nástrojmi,
- neskôr získa prístup k repozitáru,
- nakoniec používa iba testovacie a deployment nástroje.
Oprávnenia tak môžu zostať minimálne.
Automatické fallbacky
Parameter fallbacks dostal režim "default", v ktorom Anthropic volí náhradný model podľa kategórie odmietnutia.[4]
Beta vyžaduje:
server-side-fallback-2026-07-01
V aplikáciách Anthropic môžu byť niektoré blokované cyber požiadavky presmerované na Opus 4.8. Podobný mechanizmus možno zapnúť v API.[1]
Kratšie prompty môžu využiť cache
Minimálna dĺžka klesla z:
1 024 tokenov v Opus 4.8
na
512 tokenov v Opus 5
To môže zlacniť opakované system prompty a stredne dlhé agentné inštrukcie.[4]
11. Fast mode
Opus 5 ponúka Fast mode ako research preview.
Anthropic uvádza približne 2,5-krát vyššiu rýchlosť než v štandardnom režime.[1]
Cena:
- 10 USD za milión vstupných tokenov,
- 50 USD za milión výstupných tokenov.[3]
Je to dvojnásobok základnej ceny.
Fast mode je dostupný cez Claude API a usage credits v Claude Code. Dokumentácia uvádza, že zatiaľ nie je dostupný cez Amazon Bedrock, Google Cloud ani Microsoft Foundry.[4]
Má zmysel iba vtedy, keď nižšia latencia prináša skutočnú obchodnú hodnotu, napríklad pri:
- interaktívnom pair programmingu,
- reakcii na incident,
- code review na vyžiadanie,
- urgentných analýzach,
- agentovi s human-in-the-loop.
12. Bezpečnosť a obmedzenia v cybersecurity
Anthropic uvádza, že Opus 5 neposúva hranicu pri najrizikovejších dual-use schopnostiach a zostáva za Mythos 5 v biológii a ofenzívnej cybersecurity.[1]
Anthropic zámerne netrénoval Opus 5 priamo na cyber úlohách. Model sa však zlepšil v hľadaní zraniteľností vďaka všeobecnému rastu schopností.
Podľa Anthropic:
- Opus 5 sa približuje Mythos 5 pri identifikácii zraniteľností,
- zostáva výrazne slabší pri vytváraní funkčných exploitov,
- používa safety klasifikátory podobné Opus 4.8,
- má silnejšie ochrany pre úzky rozsah cyber úloh.[1]
Čo môže byť blokované?
Anthropic spomína:
- binárny vulnerability scanning,
- niektoré penetračné testy,
- generovanie exploitov.
Prospešné použitie, napríklad hľadanie zraniteľností v zdrojovom kóde, má zostať povolené.[1]
Anthropic odhaduje, že klasifikátory Opus 5 zasiahnu približne o 85 % menej často než ochrany Fable 5. Ide o prognózu výrobcu, nie nezávislé meranie.[1]
Overené organizácie a výskumníci môžu požiadať o menej obmedzenú variantu v programe Cyber Verification Program.
13. Čo hovorí Anthropic o alignment?
V automatizovanom behaviorálnom audite Anthropic získal Opus 5 skóre 2,3 za celkové misaligned správanie. Anthropic ho označuje ako najnižšie medzi svojimi novšími modelmi.[1]
Podľa Anthropic model:
- lepšie dodržiava Claude Constitution,
- menej často sa správa klamlivo,
- je ťažšie ho prinútiť k zneužitiu,
- menej často vykonáva riskantné a ťažko vratné akcie.
Ide o audit výrobcu. Výsledok neznamená, že model je neomylný, úplne bezpečný alebo odolný proti každému prompt injection.
14. Obmedzenia Claude Opus 5
Nepozná všetko po máji 2026
Reliable knowledge cutoff aj training data cutoff sú máj 2026.[2]
Pre novšie informácie potrebuje:
- webové vyhľadávanie,
- aktuálne databázy,
- nástroje,
- dokumenty vložené do kontextu.
Jeden milión tokenov nezaručuje dokonalú pamäť
Veľký kontext neodstraňuje:
- vynechané detaily,
- chybnú interpretáciu,
- konfliktné inštrukcie,
- degradáciu pri zle usporiadanom kontexte,
- rozptýlenie nerelevantnými dokumentmi.
Predvolený thinking zvyšuje nepredvídateľnosť nákladov
Rovnaký prompt môže spotrebovať rôzny počet tokenov podľa problému a effort. Aplikácia by mala merať:
- vstupné tokeny,
- výstupné tokeny,
- cache hits,
- čas odpovede,
- počet volaní nástrojov,
- celkovú cenu úlohy.
Dlhšie odpovede môžu vyžadovať úpravu promptov
Dokumentácia varuje, že odpovede a dokumenty môžu byť dlhšie než v Opus 4.8. Model tiež častejšie opisuje priebeh práce.[4]
Pre krátke výstupy je potrebné stanoviť jasné formátové obmedzenia.
Benchmark nie je produkcia
Silný benchmark nezaručuje:
- správnosť v privátnom frameworku,
- znalosť interného API,
- dodržiavanie firemných štandardov,
- absenciu regresií,
- stabilné náklady,
- dobré správanie so špecifickým agent harness.
15. Ako bezpečne migrovať z Opus 4.8?
Krok 1: nemeňte model bez testov
Pripravte reálne úlohy:
- opravu chyby,
- refaktoring,
- code review,
- tvorbu testov,
- analýzu dokumentov,
- prácu s nástrojmi,
- dlhodobú úlohu.
Krok 2: aktualizujte identifikátor
Nahraďte:
model = "claude-opus-4-8"
za:
model = "claude-opus-5"
Krok 3: skontrolujte thinking
Ak stará integrácia neposielala thinking, migrovaný model začne používať adaptívny reasoning.
Ak má thinking zostať vypnutý, nepoužívajte effort vyšší než high.
Krok 4: zvýšte max_tokens pri ťažkých úlohách
Thinking a odpoveď zdieľajú jeden limit. Príliš nízka hodnota môže prácu ukončiť skôr než pri Opus 4.8.[4]
Krok 5: odstráňte nadbytočné overovacie pokyny
Skontrolujte, či prompt nevyžaduje opakované kontroly, ktoré Opus 5 už vykonáva sám.
Krok 6: merajte cenu celej úlohy
Porovnávajte:
cenu dokončenej úlohy
čas do správneho výsledku
počet iterácií
počet tool calls
počet ručných opráv
Nie iba cenu za milión tokenov.
Krok 7: zachovajte fallback
Opus 4.8 zostáva aktívny a môže slúžiť ako:
- fallback pri odmietnutí klasifikátora,
- ochrana pred regresiou,
- stabilný model pre existujúce prompty,
- alternatíva pre špecifické cybersecurity workflow.
16. Oplatí sa prejsť na Claude Opus 5?
Áno, keď:
- agent pracuje naprieč mnohými súbormi,
- model má pracovať dlho bez stáleho dohľadu,
- dôležité je code review a hľadanie jemných chýb,
- vykonávate veľké refaktoringy,
- model používa veľa nástrojov a subagentov,
- vytvárate dokumenty, tabuľky alebo prezentácie,
- Opus 4.8 často dokončí iba časť úlohy,
- Fable 5 je príliš drahý.
Nie nevyhnutne, keď:
- úlohy sú krátke a opakované,
- Sonnet 5 už poskytuje dostatočnú kvalitu,
- latencia je dôležitejšia než maximálna presnosť,
- neboli vykonané regresné testy,
- aplikácia potrebuje vypnutý thinking pri najvyššom effort,
- cyber workflow blokujú nové klasifikátory,
- kvalitatívne zlepšenie nevyváži vyššiu spotrebu tokenov.
17. Verdikt
Claude Opus 5 nie je iba „Opus 4.8 s novým číslom“.
Najdôležitejšie zmeny sa týkajú spôsobu práce:
- thinking je štandardne zapnutý,
- dostupný je effort
max, - model častejšie overuje vlastné výsledky,
- lepšie zvláda dlhé a multi-file úlohy,
- častejšie koordinuje subagentov,
- pridáva dynamické nástroje a automatické fallbacky,
- zachováva cenu Opus 4.8.
Podľa informácií výrobcu môže Opus 5 ponúknuť veľmi dobrý pomer schopností a nákladov pri ťažkých programovacích a enterprise úlohách. Nie je však bezpodmienečne najlepšou voľbou:
- Sonnet 5 zostáva lacnejší,
- Fable 5 zostáva najvýkonnejším široko dostupným modelom Anthropic,
- väčšina benchmarkov pri uvedení pochádza od Anthropic alebo partnerov,
- každá migrácia vyžaduje vlastné testy kvality, ceny a bezpečnosti.
Najrozumnejší je routing:
Sonnet 5
pre rýchle úlohy vo veľkom objeme
Opus 5
pre ťažké, agentné a viacstupňové procesy
Fable 5
pre najťažšie prípady, keď maximálna schopnosť ospravedlní cenu
18. Checklist pred nasadením
API
- Model ID zmenené na
claude-opus-5. - Overená verzia SDK.
- Overené
max_tokens. - Zohľadnený predvolený thinking.
- Thinking nie je vypnutý pri
xhighalebomax. - Otestované spracovanie HTTP 400.
- Pridaný fallback.
- Zmeraný prompt cache.
- Overený región a cloud provider.
Kvalita
- Pripravený interný evaluačný set.
- Opus 5 porovnaný s Opus 4.8.
- Opus 5 porovnaný so Sonnet 5.
- Merané správne dokončenie úlohy, nie iba štýl.
- Otestované veľké repozitáre.
- Otestované code review.
- Otestovaný frontend a analýza obrázkov.
- Otestované dlhé dokumenty.
- Otestovaná opakovateľnosť viacerých behov.
Náklady
- Zmerané vstupné tokeny.
- Zmerané výstupné a thinking tokeny.
- Zmerané cache hits.
- Spočítané tool calls.
- Zmeraná celková cena úlohy.
- Porovnaný štandardný a Fast mode.
- Porovnané
low,medium,high,xhigh,max. - Nastavené rozpočty subagentov.
Bezpečnosť
- Skontrolované oprávnenia nástrojov.
- Obmedzené deštruktívne operácie.
- Produkčné zmeny vyžadujú schválenie.
- Otestovaný prompt injection.
- Otestované správanie cyber klasifikátorov.
- Overené logovanie a audit agenta.
- Vlastné overenie modelu sa nepovažuje za nezávislý audit.

