Mohamed ZagoudiAdelix Automation

AI

Claude Fable 5.1 en Mythos 5.1: één model, twee niveaus van waarborgen

Anthropic brengt Claude Fable 5.1 en Mythos 5.1 uit: hetzelfde model met verschillende safeguards. Beschikbaarheid, prijs, cache-tarief en benchmarks op een rij.

Abstracte technische illustratie bij het artikel over Claude Fable 5.1 en Mythos 5.1
In dit artikel
  1. Eén model, twee varianten
  2. Beschikbaarheid
  3. Prijs
  4. Benchmarks
  5. Waarborgen: minder vals-positieven
  6. Lange context
  7. Samengevat
  8. Bron

Anthropic heeft op 1 september 2026 twee nieuwe modellen uitgebracht: Claude Fable 5.1 en Claude Mythos 5.1. De constructie is opvallend en verdient eerst uitleg, omdat ze bepaalt hoe de rest van de aankondiging gelezen moet worden: volgens Anthropic zijn het hetzelfde onderliggende model, met verschillende niveaus van waarborgen (safeguards). Fable 5.1 is algemeen beschikbaar; Mythos 5.1 is uitsluitend toegankelijk via programma's met geverifieerde toegang.

Dit artikel loopt de aankondiging door: het onderscheid tussen de twee varianten, beschikbaarheid, prijs, de gerapporteerde benchmarks en wat er over de waarborgen zelf wordt gezegd.

Eén model, twee varianten

De twee namen wijzen niet op twee getrainde modellen, maar op twee configuraties van hetzelfde model:

  • Claude Fable 5.1 heeft de standaard-waarborgen die bij algemene toegang horen en is voor iedereen beschikbaar.
  • Claude Mythos 5.1 heeft minder restrictieve waarborgen op specifieke domeinen en is alleen beschikbaar voor gecontroleerde partijen binnen twee programma's:
    • het Cyber Verification Program (CVP), gericht op defensief beveiligingswerk, dat wordt uitgebreid naar modellen van de Mythos-klasse;
    • het Life Sciences Verification Program (LSVP), ontwikkeld in samenwerking met de Amerikaanse overheid, voor professionals in de levenswetenschappen, vooralsnog alleen voor Amerikaanse organisaties.

Waar de aankondiging benchmarkscores voor Mythos 5.1 apart noemt, wijzen die op wat het model kan als bepaalde waarborgen niet ingrijpen. Voor het merendeel van de benchmarks worden alleen Fable 5.1-cijfers gegeven.

Beschikbaarheid

Fable 5.1 is algemeen beschikbaar met het API-model-ID claude-fable-5-1. Het model is bereikbaar via het Claude Platform (de API), Claude Code, Claude Enterprise en Claude.ai, en via de drie grote cloudplatforms: AWS (Amazon Bedrock), Google Cloud en Microsoft Azure (Foundry).

Mythos 5.1 verschijnt niet in het reguliere aanbod; toegang loopt alleen via de hierboven genoemde programma's.

Prijs

TariefClaude Fable 5.1
Invoertokens$10 per miljoen
Uitvoertokens$50 per miljoen
Cache-reads$0,25 per miljoen (75% lager dan voorheen)

De basistarieven zijn gelijk aan die van Fable 5. Het grote verschil zit in het cache-tarief: het lezen uit de prompt-cache kost nu $0,25 per miljoen tokens, een verlaging van 75%. Omdat agentische werklasten telkens dezelfde systeeminstructies, tooldefinities en gespreksgeschiedenis opnieuw meesturen, weegt dat tarief daar zwaar mee. Anthropic rekent voor dat typische werklasten daardoor circa 25% goedkoper uitvallen dan op Fable 5, en sterk agentisch werk tot circa 45%.

Prompt-caching in één alinea

Bij prompt-caching bewaart de aanbieder een eerder verwerkt deel van de invoer (bijvoorbeeld een lange systeemprompt), zodat volgende verzoeken met hetzelfde begin dat deel niet opnieuw volledig hoeven te verwerken. Het gecachte deel wordt tegen een lager "cache-read"-tarief afgerekend. Hoe repetitiever de invoer, hoe groter het aandeel van dat tarief in de totale kosten.

Ter vergelijking: Claude Opus 5, uitgebracht in juli, kost $5 per miljoen invoertokens en $25 per miljoen uitvoertokens, de helft van Fable 5.1. De prijsverhouding tussen de twee klassen is daarmee ongewijzigd.

Benchmarks

Anthropic vergelijkt Fable 5.1 op de eigen pagina met Fable 5 en met Opus 5. De cijfers zoals gerapporteerd:

BenchmarkFable 5.1Mythos 5.1Fable 5Opus 5
Terminal-Bench-Science 0.152,6%24,7%29,0%
Terminal-Bench 4.055,8%60,9%42,0%52,3%
Humanity's Last Exam (met tools)65,0%63,8%63,6%
Humanity's Last Exam (zonder tools)60,9%57,8%56,6%
CursorBench 3.2.073,4%70,5%70,0%
OSWorld 2.0 (strict)41,7%36,1%39,6%
OSWorld 2.0 (partial)77,9%72,9%75,4%
AutomationBench31,4%17,1%26,9%
GDPval-AA v2185317231824

Drie observaties bij deze tabel:

  1. De grootste sprong zit in Terminal-Bench-Science: van 24,7% (Fable 5) naar 52,6%, ruim een verdubbeling. Ook AutomationBench laat een grote stap zien (17,1% naar 31,4%).
  2. Op Terminal-Bench 4.0 is het Mythos-cijfer hoger (60,9% tegenover 55,8%). Dat is het enige punt waar de aankondiging het effect van de verschillende waarborgen zichtbaar maakt in een score.
  3. Op Humanity's Last Exam en CursorBench zijn de verschillen klein (enkele procentpunten), en Opus 5 zit daar dicht op Fable 5.

Een kanttekening die bij elke leveranciersbenchmark hoort: de cijfers zijn door Anthropic zelf gemeten en gerapporteerd; testcondities zoals effort-niveau en aantal pogingen staan niet per benchmark in deze bron.

Waarborgen: minder vals-positieven

Een groot deel van de aankondiging gaat over het gedrag van de waarborgen. Twee cijfers:

  • De cybersecurity-waarborgen blokkeren 60% minder vals-positieve verzoeken dan voorheen: legitieme vragen die eerder onterecht werden geweigerd, komen nu vaker door.
  • De biologie-waarborgen grijpen 85% minder vaak in bij goedaardige verzoeken over elementaire biologie en medische vragen.

Tegelijk stelt Anthropic dat het model kwaadwillende verzoeken in agentische context weigert op een niveau vergelijkbaar met eerdere modellen. De strekking is dus niet dat er minder wordt geweigerd, maar dat er gerichter wordt geweigerd.

Anthropic benoemt ook waar het eigen zicht beperkt is: de geautomatiseerde gedragsaudit geeft "minder inzicht in werk met zeer lange context en in multi-agent-omgevingen", en de dekking van onmogelijke taken is kleiner dan gewenst.

Lange context

De aankondiging noemt verbeterde prestaties bij lang lopende probleemoplossing en bij "lang, onbeheerd werk", en spreekt van betere consistentie over lange contexten. Wat het contextvenster zelf betreft (het maximale aantal tokens dat het model in één verzoek kan verwerken): daar staat geen getal in de aankondiging. Wie daar een concrete waarde voor nodig heeft, moet die in de modeldocumentatie nazoeken; uit deze bron is die niet af te leiden.

Samengevat

Claude Fable 5.1 en Mythos 5.1 zijn hetzelfde model met verschillende waarborgen. Fable 5.1 is algemeen beschikbaar (claude-fable-5-1) via het Claude Platform, Claude Code, Claude Enterprise en de drie grote clouds; Mythos 5.1 alleen via het Cyber Verification Program en het (Amerikaanse) Life Sciences Verification Program. De tokentarieven blijven $10/$50 per miljoen, maar cache-reads dalen naar $0,25, waardoor typische werklasten circa 25% en sterk agentische werklasten tot circa 45% goedkoper worden. De benchmarks laten de grootste winst zien op Terminal-Bench-Science en AutomationBench; de waarborgen geven minder vals-positieven bij gelijkblijvende weigering van kwaadwillende verzoeken. Het contextvenster is in de aankondiging niet gespecificeerd.

Bron

Over de auteur

Mohamed Zagoudi

Freelance systeembeheerder & ICT-coördinator

Dit artikel is gebaseerd op eigen praktijkervaring in ICT-beheer en automatisering en bevat geen verwijzingen naar specifieke klanten.

Vragen over dit onderwerp?

Stuur me gerust een bericht. Ik reageer zelf.