Dôležité AI Novinky AI Nástroje

Anthropic predstavil Claude Fable 5. Nový AI model zvládne dlhé úlohy, vývoj aj prácu s obrazom

TL;DR

  • Fable pre všetkých

    Claude Fable 5 je všeobecne dostupný model pre náročné úlohy, dlhé zadania, programovanie, analýzy, obrazové vstupy a prácu s veľkým množstvom textu.

  • Mythos iba vybraným

    Mythos 5 má rovnaké schopnosti, ale bez časti bezpečnostných filtrov. Dostanú sa k nemu len schválení partneri cez Project Glasswing.

  • Miliónový kontext

    Oba modely podporujú kontext až 1 milión tokenov a výstup do 128-tisíc tokenov, čo pomôže pri veľkých dokumentoch a projektoch.

Anthropic predstavil Claude Fable 5 a obmedzene dostupný Mythos 5. Nové modely sľubujú dlhší kontext, silnejšie uvažovanie a prísnejšie bezpečnostné pravidlá pre vývojárov aj firmy.

Anthropic predstavil dvojicu nových modelov Claude Fable 5 a Claude Mythos 5. Pre bežných používateľov, vývojárov a firmy je dôležitý najmä Claude Fable 5, ktorý je označený ako najvýkonnejší široko dostupný model firmy. Má byť určený na úlohy, ktoré si vyžadujú dlhšie rozmýšľanie, prácu s veľkým množstvom textu, programovanie, analýzy dokumentov, obrazové vstupy aj zložitejšie projekty, ktoré netrvajú minúty, ale pokojne celé hodiny.

Claude Fable 5 cieli na náročné úlohy

Claude Fable 5 nie je model určený len na krátke odpovede typu „napíš e-mail“ alebo „zhrň článok“. Anthropic ho prezentuje ako riešenie pre dlhšie a zložitejšie zadania. To znamená, že by mal lepšie zvládať projekty, kde treba držať v pamäti veľa informácií a postupovať krok za krokom.

Príkladom môže byť vývoj softvéru. Firma môže modelu zadať veľkú časť kódu, popísať, čo treba zmeniť, a očakávať návrh úprav naprieč celým projektom. Podobne môže právnik alebo analytik pracovať s veľkým balíkom dokumentov a pýtať sa na rozdiely, riziká alebo dôležité súvislosti.

Veľkým lákadlom je kontextové okno s veľkosťou 1 milión tokenov. V ľudskej reči ide o schopnosť pracovať s obrovským množstvom textu naraz. Token si môžeme predstaviť ako malú časť slova alebo textu. Čím väčší kontext model zvládne, tým viac dokumentov, kódu alebo poznámok vie naraz zohľadniť.

Dlhší výstup pomôže pri veľkých projektoch

Claude Fable 5 a Claude Mythos 5 majú podporovať aj výstup do 128-tisíc tokenov na jednu požiadavku. To je dôležité najmä pri tvorbe rozsiahlejších výstupov. Model tak nemusí skončiť pri krátkej odpovedi, ale môže pripraviť dlhší dokument, technický návrh, plán migrácie alebo veľkú časť kódu.

Príklad: ak vývojár potrebuje pripraviť návrh prestavby aplikácie, model môže nielen vysvetliť problém, ale rovno navrhnúť postup, upraviť štruktúru projektu a pripraviť väčší balík zmien. Pri klasickom chatbote by bolo potrebné zadanie deliť na veľa menších častí.

Podobne to môže pomôcť vo firmách. Model môže spracovať dlhú internú dokumentáciu, vytiahnuť z nej dôležité informácie a pripraviť prehľad pre manažment. Namiesto ručného čítania desiatok strán môže používateľ dostať jasný výstup s odporúčaniami.

Mythos 5 nebude pre každého

Popri Fable 5 prichádza aj Claude Mythos 5. Ten má mať rovnaké schopnosti, no líši sa v bezpečnostných obmedzeniach. Anthropic ho sprístupňuje iba vybraným zákazníkom cez Project Glasswing. Ide najmä o schválených partnerov z oblasti kybernetickej obrany, kritickej infraštruktúry a neskôr aj vybraných výskumníkov.

Dôvod je jednoduchý. Veľmi výkonné AI modely môžu byť užitočné, ale aj rizikové. Môžu pomôcť pri hľadaní chýb v softvéri, ochrane systémov alebo výskume liekov. V nesprávnych rukách by však podobné schopnosti mohli uľahčiť kybernetické útoky alebo nebezpečný výskum.

Pre bežného používateľa to znamená, že Mythos 5 pravdepodobne neuvidí v klasickej ponuke. V praxi bude dostupný najmä organizáciám, ktoré prejdú schvaľovaním a majú jasný dôvod používať model s voľnejšími pravidlami.

Fable 5 má bezpečnostné poistky

Claude Fable 5 má bezpečnostné filtre, ktoré môžu pri niektorých požiadavkách zasiahnuť. Ak model vyhodnotí zadanie ako rizikové, nemusí odpovedať priamo. V niektorých prípadoch má požiadavku prevziať iný model, napríklad Claude Opus 4.8.

Pre používateľa to môže znamenať dve veci. Pri bežných úlohách si zrejme nič nevšimne. Pri citlivejších témach, napríklad kybernetickej bezpečnosti, biológii, chémii alebo pokusoch o obchádzanie pravidiel, môže systém odpovedať opatrnejšie.

Anthropic zároveň priznáva, že filtre môžu niekedy zachytiť aj neškodné otázky. To je nevýhoda prísnejšieho nastavenia. Firma však tvrdí, že takýto prístup zvolila preto, aby mohla výkonnejší model sprístupniť širšiemu okruhu používateľov bez zbytočného rizika.

Cena a dostupnosť pre vývojárov

Claude Fable 5 je dostupný cez Claude API, Claude Platform on AWS, Amazon Bedrock, Vertex AI a Microsoft Foundry. Vývojári ho môžu volať cez modelové ID claude-fable-5.

Cena je nastavená na 10 dolárov za milión vstupných tokenov a 50 dolárov za milión výstupných tokenov. Pre menšie pokusy to nemusí znieť dramaticky, ale pri veľkých firemných projektoch, kde sa spracúvajú obrovské dokumenty alebo veľké kódové základne, pôjde o náklad, ktorý si firmy budú musieť dobre počítať.

Príklad: startup môže Fable 5 použiť na analýzu zákazníckej podpory, vývoj nových funkcií alebo kontrolu dokumentácie. Väčšia firma ho môže nasadiť na prácu s internými znalosťami, kódom alebo dlhodobými agentmi, ktorí riešia úlohy vo viacerých krokoch.

Reťazec myšlienok neuvidíte

Zaujímavou zmenou je aj spôsob práce s uvažovaním modelu. Claude Fable 5 a Mythos 5 majú adaptívne premýšľanie vždy zapnuté. Používateľ však neuvidí surový reťazec vnútorného uvažovania. Namiesto toho môže dostať len zhrnutú verziu premýšľania, ak to vývojár zapne.

To je dôležité najmä pre firmy, ktoré chcú vedieť, prečo model niečo odporučil, ale zároveň nechcú alebo nemôžu pracovať so surovým interným procesom modelu. V praxi môže stačiť čitateľné zhrnutie: čo model zvažoval, na čom postavil odpoveď a kde si nie je istý.

AI modely sa posúvajú k samostatnej práci

Claude Fable 5 ukazuje, kam sa veľké AI modely posúvajú. Už nejde iba o chatovanie. Cieľom je zvládať dlhé, náročné a viacstupňové úlohy, kde model pracuje s veľkým množstvom podkladov, nástrojmi a vlastnými poznámkami.

Pre používateľov to môže byť užitočné najmä v oblastiach, kde je veľa textu, pravidiel alebo kódu. Napríklad pri programovaní, finančnej analýze, výskume, práci s dokumentmi, tvorbe produktových plánov alebo kontrole veľkých projektov.

Zároveň platí, že čím výkonnejší model, tým väčšia zodpovednosť. Anthropic preto pri Fable 5 kombinuje vysoký výkon s prísnejšími pravidlami. Pre niekoho to môže byť obmedzujúce, no pre širšie nasadenie v praxi je to pravdepodobne nevyhnutný kompromis.

Claude Fable 5 tak neprináša len vyšší výkon. Prináša aj jasný signál, že ďalšia generácia AI bude viac o dlhodobej práci, veľkom kontexte, nástrojoch a bezpečnejšom nasadení vo firmách. A práve tam sa môže rozhodnúť, ktoré modely sa stanú skutočne užitočnými, nielen pôsobivými na papieri.

SmartArena.sk · AI modely a firmy

Claude Fable 5 a Mythos 5: čo ukazujú čísla

Anthropic posúva Claude od bežného chatovania k dlhým projektom, programovaniu, práci s veľkými dokumentmi a agentom, ktorí riešia viac krokov naraz.

1 mil. tokenov v kontexte
128 tis. tokenov výstupu
10 / 50 USD input / output za milión tokenov
Hlavná pointa: Claude Fable 5 je model pre širšie nasadenie s bezpečnostnými filtrami. Claude Mythos 5 ukazuje podobné schopnosti, no s voľnejšími obmedzeniami a preto bude dostupný iba vybraným organizáciám.

Dva modely, dve cieľové skupiny

Pre bežných používateľov, firmy a vývojárov je dôležitý najmä Fable 5. Mythos 5 zostáva v kontrolovanom režime.

Dostupnosť a bezpečnosť

Claude Fable 5

Široko dostupný model pre náročné uvažovanie, veľké dokumenty, programovanie, obrazové vstupy a viacstupňové úlohy.

  • API model ID: claude-fable-5
  • Dostupnosť cez Claude API, AWS, Amazon Bedrock, Vertex AI a Microsoft Foundry
  • Má bezpečnostné filtre a pri citlivých úlohách môže odpovedať opatrnejšie

Claude Mythos 5

Model s podobnými schopnosťami, ale s voľnejšími bezpečnostnými pravidlami. Preto je dostupný iba cez Project Glasswing.

  • Určený najmä pre kybernetickú obranu, kritickú infraštruktúru a schválený výskum
  • Nie je určený pre bežnú verejnú ponuku
  • V grafoch ukazuje vysoký výkon aj v citlivých benchmarkoch

Čo to znamená v praxi

Nové modely nie sú len rýchlejší chatbot. Cieľom je dlhá práca s veľkým kontextom a nástrojmi.

Použitie vo firmách

Veľký kontext

Model môže naraz pracovať s rozsiahlymi dokumentmi, kódom, poznámkami alebo internými podkladmi.

Dlhý výstup

Výstup do 128-tisíc tokenov pomôže pri veľkých technických návrhoch, plánoch alebo úpravách kódu.

Agentické úlohy

Modely cielia na projekty, ktoré majú viac krokov a môžu trvať dlhšie než bežná odpoveď v chate.

Bezpečnostný kompromis

Fable 5 má filtre. Mythos 5 je voľnejší, ale práve preto bude dostupný len obmedzene.

Agentické programovanie

V priložených grafoch má Fable 5 silné výsledky najmä v SWE-Bench Pro a FrontierCode Diamond.

Vyššie skóre je lepšie

SWE-Bench Pro

Úspešnosť riešenia softvérových úloh v percentách.

Claude Fable / Mythos 5
80,3 %
Claude Mythos Preview
77,8 %
Claude Opus 4.8
69,2 %
GPT 5.5
58,6 %
Gemini 3.1 Pro
54,2 %

FrontierCode Diamond

Najťažšia časť benchmarku. Tu je rozdiel medzi Fable 5, Opus 4.8 a GPT 5.5 veľmi výrazný.

Claude Fable 5
29,3 %
Claude Opus 4.8
13,4 %
GPT 5.5
5,7 %
Interpretácia: Fable 5 má v tomto grafe viac než dvojnásobok výsledku Opus 4.8 a približne päťnásobok výsledku GPT 5.5.

Kyberbezpečnosť a filtre

Pri citlivých ofenzívnych úlohách je dôležité rozlišovať medzi schopnosťou modelu a tým, čo má verejný model povoliť.

Nižšie môže byť bezpečnejšie

Cyber adversarial robustness eval

Úspešnosť dokončenia ofenzívnej úlohy pri automatizovanom red-teamingu. V tomto grafe je nižšia hodnota lepšia.

Claude Opus 4.6
83,2 %
Claude Opus 4.7
72,7 %
Claude Opus 4.8
56,6 %
Claude Fable 5
5,4 %
Čo z toho vyplýva: Fable 5 má podľa grafu výrazne nižšiu úspešnosť nežiaduceho ofenzívneho dokončenia úloh.

Ofenzívne cyber evaluácie

Vyššie číslo znamená vyššiu úspešnosť úlohy. Pri verejnom modeli však vysoké číslo v citlivých úlohách nemusí byť želané.

Firefox

Mythos 588,4
Mythos Preview70,8
Opus 4.8 bez poistiek8,8
Fable 50,0

CyberGym

Mythos 583,8
Mythos Preview83,1
Opus 4.8 bez poistiek78,1
Fable 50,0

CyScenarioBench

Mythos 538,7
Mythos Preview29,2
Opus 4.8 bez poistiek16,6
Fable 50,0

Výskum a správanie modelov

Grafy ukazujú aj experimentálne biologické skóre a mieru nežiaduceho správania.

Širší pohľad

Viral capsid property prediction

Experimentálna klasifikácia AAV balenia. Hodnoty z boxplotu sú zaokrúhlené.

Claude Mythos 5
~0,85
Claude Mythos Preview
~0,84
Claude Opus 4.8
~0,80
Protein LM baseline
~0,70

Misaligned behavior

Skóre na škále 1 až 10. Nižšia hodnota znamená menej nežiaduceho správania.

Claude Sonnet 4.6
2,81
Claude Mythos Preview
1,90
Claude Opus 4.8
2,05
Claude Mythos 5
2,06

Vybrané benchmarky v skratke

Namiesto širokej tabuľky sú výsledky rozdelené do mobilných kariet, aby sa na webe nestrácali mimo obrazovky.

Mobilná benchmarková mapa

Agentic coding SWE-Bench Pro

Fable / Mythos 580,3 %
Mythos Preview77,8 %
Opus 4.869,2 %
GPT 5.558,6 %

Knowledge work GDPval-AA

Fable / Mythos 51932
Opus 4.81890
GPT 5.51769
Gemini 3.1 Pro1314

Spatial reasoning Blueprint-Bench 2

Fable / Mythos 538,6 %
GPT 5.536,2 %
Gemini 3.1 Pro26,5 %
Opus 4.814,5 %

Computer use OSWorld-Verified

Mythos Preview85,4 %
Fable / Mythos 585,0 %
Opus 4.883,4 %
GPT 5.578,7 %

Terminal-Bench 2.1 Agentic coding

Fable / Mythos 588,0 %*
GPT 5.583,4 %
Opus 4.882,7 %
Gemini 3.1 Pro70,7 %

HealthBench Professional Health

Fable / Mythos 566,0 %*
Mythos Preview64,7 %
Opus 4.856,9 %
GPT 5.551,8 %
Poznámka: hviezdičkou označené výsledky môžu byť ovplyvnené bezpečnostnými filtrami alebo fallback správaním. Pri Fable 5 a Mythos 5 je v tabuľke použitý vyšší z blízkych výsledkov.

Čo si z toho odniesť

Výkon je len jedna časť príbehu. Rovnako dôležitá je dostupnosť, cena a bezpečnostné pravidlá.

Zhrnutie pre čitateľa

Fable 5 je model pre prax

Najdôležitejší je pre firmy a vývojárov, ktorí potrebujú dlhé kontexty, veľké výstupy, prácu s kódom a analýzu dokumentov.

Mythos 5 ukazuje maximum

Mythos 5 naznačuje, čo model zvládne pri voľnejších pravidlách, no práve preto bude dostupný len v prísne kontrolovanom režime.

Bezpečnostné filtre majú cenu

Pri citlivých témach môže Fable 5 odmietnuť odpoveď alebo postupovať opatrnejšie. Pre široké nasadenie je to zámerný kompromis.

Zdroj dát: blog Anthropic a priložené benchmarkové grafy. Hodnoty z boxplotov sú zaokrúhlené a slúžia ako orientačné vizuálne zhrnutie. Firemné benchmarky nie sú nezávislým redakčným testom.
Fakticky overené

Použité zdroje

Preferovaný zdroj v Google

Ak vám naše články pomáhajú sledovať technológie, financie a AI v súvislostiach, pridajte si SmartArena medzi preferované zdroje v Google.

Pridať SmartArena v Google

Komentáre

Pridať komentár