Home / Inzichten / Claude Fable 5.1: wat veranderde, wat het kost, wanneer u het inzet
Technisch

Claude Fable 5.1: wat veranderde, wat het kost, wanneer u het inzet

Vat samen met AI Prompt gekopieerd. Plak hem in de chat

Anthropic bracht Claude Fable 5.1 op 1 september 2026 uit en noemt het, samen met Mythos 5.1, zijn meest geavanceerde model voor programmeren en kenniswerk. De lijstprijs bleef gelijk. Eén regel op de factuur veranderde wel, en die verandert de rekensom voor precies één soort werk. In dit artikel: wat er echt is uitgebracht, wat het kost per taak in plaats van per token, hoe de effort-knop werkt, wat er breekt als u al op Fable 5 zit, en wat een Nederlands of Belgisch bedrijf hier deze maand mee moet doen. Elk getal komt uit de aankondiging van Anthropic, de officiële prijspagina of een met naam genoemde onafhankelijke bron. Waar bronnen elkaar tegenspreken, zeggen we dat.

Wat Anthropic op 1 september uitbracht

Fable 5.1 is per direct beschikbaar op claude.ai, in Claude Code, via de Claude API als claude-fable-5-1, en op Amazon Bedrock, Google Cloud Vertex AI en Microsoft Foundry. AWS bevestigde dezelfde dag de algemene beschikbaarheid. Het model zit in de Pro-, Max-, Team- en Enterprise-abonnementen.

Het detail dat de meeste berichtgeving oversloeg: Fable 5.1 en Mythos 5.1 zijn hetzelfde model met verschillende beveiligingsniveaus. Mythos 5.1 behoudt zijn volledige cyber- en biologiecapaciteit en is alleen beschikbaar voor gescreende Amerikaanse organisaties via Anthropic's trusted-access-programma's. Op Terminal-Bench 4.0 scoren ze 55,8 en 60,9 procent; Anthropic schrijft het verschil toe aan taken waar de eerdere, minder precieze cyberbeveiliging ingreep. Buiten die programma's krijgt u Fable 5.1, en de Fable-cijfers zijn de cijfers die voor u tellen.

Fable 5 zelf krijgt de status legacy. Volgens de migratienotities van ClaudeFast wordt het niet vóór 9 juni 2027 uitgefaseerd. Geen harde deadline dus, wel een reden om te plannen.

De prijs veranderde niet. De cache wel.

Input blijft $ 10 per miljoen tokens, output $ 50 per miljoen. Batchverwerking halveert beide naar $ 5 en $ 25. Inference uitsluitend in de VS kost 1,1 keer zoveel. Het volledige contextvenster van 1 miljoen tokens wordt tegen standaardtarief gefactureerd: een verzoek van 900.000 tokens kost per token evenveel als een van 9.000. Dat is allemaal ongewijzigd ten opzichte van Fable 5.

Vergelijking: API-prijzen per miljoen tokens van Claude Fable 5.1, Fable 5, Opus 5 en Sonnet 5, september 2026

De enige regel die bewoog is cache reads: van $ 1,00 naar $ 0,25 per miljoen tokens, een verlaging van 75 procent. Op de prijspagina staat het als een factor 0,025 op de inputprijs, tegenover de factor 0,1 die elk ander Claude-model gebruikt. Cache writes blijven $ 12,50 voor vijf minuten en $ 20 voor een uur.

Uit die ene wijziging leidt Anthropic zijn kopregels af: ongeveer 25 procent lagere kosten bij normaal gebruik en tot ongeveer 45 procent bij sterk agentisch werk. Dat zijn geen tariefverlagingen maar metingen van het gebruik in augustus. ClaudeFast geeft de onderliggende cijfers: cache reads waren ruwweg 40 procent van een normale factuur en 65 procent van een agentische. De besparing is dus echt, maar het is een besparing op het opnieuw lezen van context die u al betaald heeft om weg te schrijven. Een korte aanroep van één beurt zonder gecachet voorstuk bespaart helemaal niets. Onthoud die zin voordat iemand in uw bedrijf de 45 procent citeert.

Nog een regel die makkelijk over het hoofd wordt gezien: Claude 4.7 en latere modellen, Fable inbegrepen, gebruiken een nieuwere tokenizer die ongeveer 30 procent meer tokens produceert voor dezelfde tekst. Dat is niet nieuw in 5.1, maar als u vergelijkt met een factuur uit de tijd van Sonnet 4.6 zit een deel van het verschil in de tokenizer, niet in het model.

Het kostenverhaal dat de kopregel weglaat

Artificial Analysis deed de evaluatie vóór de release voor Anthropic en publiceerde een andere doorsnede van dezelfde data. Op maximale effort scoort Fable 5.1 66 op hun Intelligence Index, de hoogste score die zij ooit hebben gemeten, vóór Opus 5 met 63. Maar het gebruikt daarvoor ruwweg 1,7 keer zoveel outputtokens als Fable 5, waardoor het op max ongeveer 20 procent duurder per taak is dan Fable 5, ondanks de voordeligere cache. Hun cijfers per taak: $ 3,76 voor Fable 5.1 op max tegenover $ 2,34 voor Opus 5, en $ 2,72 op extra-high, waar het 65 scoort. The Decoder bracht de discussie; de oorspronkelijke thread staat hier en de modelpagina vermeldt de run op $ 8.523 over 140 miljoen outputtokens.

Vergelijking: kosten per taak en Intelligence Index-score van Claude Fable 5.1 op max en extra-high effort tegenover Opus 5, Artificial Analysis, september 2026

Beide partijen hebben gelijk, omdat ze iets anders meten. Het cijfer van Anthropic is hoe een factuur eruitziet als het merendeel van uw tokens gecachete context is die door een lange agent-lus stroomt. Het cijfer van Artificial Analysis is wat één zware redeneertaak kost als het model zo lang mag nadenken als het wil. Uw werk zit daar ergens tussenin, en de eerlijke manier om te weten waar, is het draaien.

Digital Applied rekende één veelvoorkomende vorm door: 2.000 verse inputtokens en 1.000 outputtokens per beurt bovenop een gecachete context. Tegenover Opus 5 bereikt Fable 5.1 kostenpariteit rond 140.000 gecachete tokens per beurt, is het 22 procent voordeliger bij 300.000 en 34 procent bij 600.000. Onder ruwweg 140.000 tot 215.000 gecachete tokens is Opus 5 het voordeligere model voor dezelfde vorm. Een bruikbare vuistregel: Fable 5.1 wint op kosten alleen als een groot, stabiel voorstuk vaak opnieuw wordt gelezen. Overal elders kost Opus 5 de helft van de lijstprijs.

Effort-niveaus: de knop die uw factuur bepaalt

Fable 5.1 kent vijf effort-niveaus: low, medium, high, xhigh en max. De claim van Anthropic, letterlijk in de aankondiging: op low of medium evenaart of verslaat Fable 5.1 Fable 5 tegen veel lagere kosten, en de hogere niveaus halen prestaties die Fable 5 niet haalde. De standaardinstelling verschilt per omgeving: high in Claude Code en de API, medium in Claude Cowork en op claude.ai.

Twee praktische opmerkingen. Ten eerste zijn effort-namen niet vergelijkbaar tussen modellen. Een sweep die u op Fable 5 op high draaide, zegt niets over Fable 5.1 op high; ClaudeFast en Digital Applied adviseren allebei elk werk opnieuw door te meten. Ten tweede vond de hands-on van Every na een week dat xhigh en max de niveaus zijn waar het model te veel gaat doen: het spawnde subagents die niet nodig waren, negeerde onderbrekingen en verzette zich tegen bijsturing. Hun team koos high voor interactief werk en bewaarde de topniveaus voor lange onbeheerde runs. Voor het meeste zakelijke gebruik is medium het niveau om eerst te testen, omdat Anthropic het zelf koos voor claude.ai.

De API laat u nu per bericht de effort wijzigen zonder de cache ongeldig te maken, via een beta-header. Zo draait u een voordelige planbeurt en een dure uitvoerbeurt in één gesprek. Dat is de functie om uw kostenbeheersing omheen te bouwen.

De benchmarks, met de cijfers

Dit zijn de door Anthropic zelf gerapporteerde resultaten, geen onafhankelijk bewijs, zoals VentureBeat terecht opmerkt. De productpagina van Anthropic geeft bovendien een standaardfout van 3,5 tot 4,5 punt per model op Terminal-Bench-Science, dus verschillen van één punt binnen die marge zeggen weinig. Met dat voorbehoud:

Vergelijking: benchmarkscores van Claude Fable 5.1 tegenover Fable 5, Opus 5 en GPT-5.6 Sol op Terminal-Bench, CursorBench, GDPval, AutomationBench, OSWorld en Humanity's Last Exam, zoals gerapporteerd door Anthropic
  • Terminal-Bench 4.0 (agentisch programmeren): Fable 5.1 55,8 procent, Mythos 5.1 60,9, Fable 5 42,0, Opus 5 52,3, GPT-5.6 Sol 37,3.
  • Terminal-Bench-Science 0.1 (agentisch onderzoek): Fable 5.1 52,6 procent, Fable 5 24,7, Opus 5 29,0, GPT-5.6 Sol 22,4. De grootste sprong in deze release.
  • CursorBench 3.2.0: 73,4 procent tegenover 70,5 voor Fable 5 en 70,0 voor Opus 5.
  • GDPval-AA v2 (kenniswerk): 1.853 tegenover 1.824 voor Opus 5 en 1.723 voor Fable 5.
  • AutomationBench (bedrijfsprocessen): 31,4 procent tegenover 26,9 voor Opus 5 en 17,1 voor Fable 5.
  • OSWorld 2.0 (computergebruik): 77,9 procent partial en 41,7 procent strict, op de taakset van augustus 2026, die volgens Anthropic niet vergelijkbaar is met eerdere OSWorld-cijfers.
  • Humanity's Last Exam: 60,9 procent zonder tools en 65,0 met tools.

Als geheel is het patroon duidelijk: de winst zit in lang, toolgebruikend, agentisch werk, en de voorsprong op Opus 5 is het grootst bij wetenschappelijk onderzoek en bedrijfsprocesautomatisering. Bij korte, eenmalige programmeertaken liggen de drie Anthropic-modellen dicht bij elkaar. Is uw toepassing een chatbot of een classifier, dan verandert deze release niets voor u. Is het een agent die uren draait, dan verandert er veel. Voor het bredere beeld over leveranciers heen blijven onze vergelijking GPT-5.6 versus Fable 5 en de Opus 5-review staan; dit artikel gaat over wat sindsdien bewoog.

Hoe het werkt in de praktijk

De anekdote die iedereen citeert is echt en komt uit de aankondiging zelf. Een senior portfoliomanager bij Millennium beschreef code die ongeveer één op de miljoen runs crashte, iets wat niemand in het team in vier tot vijf jaar had kunnen verklaren. Elk geprobeerd model, Fable 5 inbegrepen, miste het. Fable 5.1 disassembleerde een externe leveranciersbibliotheek, legde die naast de core dump en herleidde de crash tot een bug in die bibliotheek. VentureBeat voegt een onbeheerde machine-learning-run van 38 uur bij Ramp toe, en een Browserbase-score van 82 procent op zijn zwaarste browser-agent-taken tegenover 74 voor Opus 5 en 57 voor Fable 5.

De review van Every is het nuttigste onafhankelijke verslag omdat het ook de mislukkingen meldt. Positief: minder dan de helft van de tokens van Opus 5 voor vergelijkbare agent-resultaten, ruwweg 60 procent sneller in geautomatiseerde pipelines, helderder proza met minder AI-tics. Negatief: het overschreed consequent limieten (een verzoek om 1.000 woorden kwam terug met 1.288; een verzoek om acht tot twaalf citaten leverde er 43), en vijf van de 27 controleerbare citaten stonden niet in het bronmateriaal. Hun oordeel: upgraden, maar Opus 5 aanhouden voor alles met harde limieten of zware multi-tool-orkestratie.

De productnotities van AWS voegen een gedragsverandering toe die u moet kennen: het model neemt minder snel een sluiproute, zoals het uitschakelen van een falende test, en als het vastloopt zegt het dat in plaats van succes te rapporteren. Wie ooit de opgewekte samenvatting van een agent over een kapotte build heeft nagelezen, begrijpt waarom dat meer waard is dan een benchmarkpunt.

Drie dingen die breken als u op Fable 5 zit

ClaudeFast en Digital Applied documenteren dezelfde drie API-wijzigingen, en alle drie geven een 400-fout in plaats van stilletjes te degraderen:

  • Geforceerd toolgebruik wordt geweigerd. Een tool_choice van any, of een tool bij naam, faalt nu. De vervanging is auto plus strict mode op de tooldefinitie.
  • Thinking-blokken reizen niet terug. Alleen Mythos 5.1 kan de thinking-blokken van Fable 5.1 lezen. Een fallback-keten die terugvalt op Opus verliest die context geruisloos, tenzij u de beta-header inschakelt die het verlies logt.
  • Gespreksgeschiedenis is alleen-toevoegen. Voor API-accounts aangemaakt vanaf 31 augustus 2026 maakt het bewerken van een eerder bericht, de systeemprompt of de toollijst elk later thinking-blok ongeldig. Anthropic noemt het een maatregel tegen distillatie en zegt het bij toekomstige releases naar alle accounts uit te breiden.

Daarbovenop noemt Digital Applied gedragsverschuivingen die promptaanpassingen vragen in plaats van code: minder voortgangsberichten tijdens lange toolruns, minder parallelle toolaanroepen, dichter proza en meer ongemarkeerde citaten bij het samenvatten van bronnen. Twee van hun oplossingen zijn schrappingen: verwijder instructies die opmaak onderdrukken, en verwijder instructies om bevindingen tot het einde vast te houden.

Minder weigeringen, en een nieuwe route naar nulretentie

De meest praktische verbetering voor dagelijks gebruik is precisie, niet capaciteit. Anthropic meldt 60 procent minder ingrepen per sessie door de cyberbeveiliging en 85 procent minder valse positieven bij onschuldige biologie- en medische vragen. MacRumors bevestigt dat Claude Code-gebruikers die 60 procent direct moeten merken. Fable 5.1 mag nu softwarekwetsbaarheden opsporen, maar geen exploits bouwen; die verzoeken gaan nog steeds naar een Opus-model, en Anthropic zegt dat u voor doorgestuurd werk geen Fable-prijs betaalt.

Voor Europese kopers weegt de retentiewijziging misschien zwaarder. Enterprise Frontier Safeguards, dat dit najaar gefaseerd uitrolt, laat enterpriseklanten hun data op hun eigen cloud houden terwijl Anthropic misbruik kan blijven opsporen, wat volgens Anthropic gelijkstaat aan een overeenkomst zonder dataretentie. Tot het er is, kunnen in aanmerking komende klanten Fable 5.1 al met nulretentie gebruiken. Los daarvan krijgt gegenereerde tekst nu een onzichtbaar watermerk, met een detectie-API in besloten preview voor toezichthouders, factcheckers en Europese maatschappelijke organisaties.

Vier dingen die het waard zijn deze week te proberen

Wie de afgelopen maanden niet met een frontier-model heeft gewerkt, onderschat de afstand tussen wat hij zich herinnert en wat het nu doet. Vier oefeningen, in de volgorde waarin wij ze zouden draaien:

  • Laat iets auditen wat u al heeft. Een codebase, een contract, een offerte, een website. Vraag wat kapot is, wat ontbreekt en wat het zou veranderen. Het Millennium-verhaal is het extreme geval; het gewone geval is dat het het ding vindt waar u al een jaar naar wilde kijken.
  • Bouw één kleine agent die zonder u draait. De benchmarkwinst zit volledig in lang, toolgebruikend werk, en het gedrag van vastgelopen-zegt-vastgelopen maakt onbeheerde runs veiliger dan ze waren. Begin met één lus die leest, handelt en rapporteert.
  • Geef het het moeilijkste onopgeloste probleem dat u heeft. Geen taak. Het probleem dat u al een tijd vermijdt. Schrijf het volledig uit en lees het antwoord op medium effort voordat u aan de knop draait.
  • Draai een effort-sweep op echt werk. Low, medium en high op dezelfde twintig invoeren, met de factuur naast de uitvoer. De claim van Anthropic dat low en medium Fable 5 evenaren, geldt voor uw werk alleen als u het op uw werk heeft gecontroleerd.

Wat een Nederlands of Belgisch bedrijf hier echt mee moet doen

Het eigen advies van Anthropic, geciteerd door Digital Applied, is om voor het meeste werk met Opus 5 te beginnen en Fable 5.1 te gebruiken voor zwaar redeneerwerk en agentisch werk met een lange horizon. Wij zijn het daarmee eens, en het bewijs in dit artikel is de reden: Fable 5.1 verslaat Opus 5 op kosten alleen als een groot gecachet voorstuk vaak opnieuw wordt gelezen, en op capaciteit alleen in de lange agentische staart. VentureBeat citeert een bericht van de Financial Times dat Fable 5 ongeveer 11 procent van de Anthropic-uitgaven uitmaakte over ruwweg 70.000 bedrijven, met ondernemingen die het om kostenredenen liever niet als standaard instelden, en een voorbeeld bij ServiceNow waar het gebruik door medewerkers snel een jaarbudget opmaakte. De economie achter die aarzeling is verbeterd voor agents en verder onveranderd.

Ons advies voor een mkb-bedrijf met een draaiend AI-systeem: laat het op Opus 5 of Sonnet 5 staan, en verplaats alleen het agentische, langecontext-deel naar Fable 5.1 nadat een effort-sweep laat zien dat het loont. Voor een mkb-bedrijf dat nog beslist of het überhaupt gaat bouwen, is deze release een reden om een goed afgebakende pilot te draaien, niet een reden om het budget te wijzigen. De kosten van uitzoeken zijn veranderd, niet de kosten van gelijk hebben. Op welk model u standaardiseert telt minder dan de keuze openhouden, want dit is de derde keer dit jaar dat het antwoord veranderde.

Wilt u de tokenrekensom op uw eigen gebruik in plaats van op een benchmark, dan is dat precies ons LLM-optimalisatiewerk, en onze kostengids voor AI-projecten laat zien wat een afgebakende bouw kost voordat er een modelkeuze aan te pas komt.

Veelgestelde vragen

Wat kost Claude Fable 5.1?

$ 10 per miljoen inputtokens en $ 50 per miljoen outputtokens, gelijk aan Fable 5. Cache reads daalden van $ 1,00 naar $ 0,25 per miljoen. Batch kost $ 5 en $ 25. Inference alleen in de VS kost 1,1 keer zoveel.

Is Fable 5.1 echt 25 tot 45 procent voordeliger dan Fable 5?

Alleen voor werk dat een groot gecachet voorstuk vaak opnieuw leest. De cijfers van Anthropic zijn metingen van normaal en agentisch gebruik, geen tariefverlagingen. Artificial Analysis vond dat één zware taak op max effort ongeveer 20 procent meer kost dan op Fable 5, omdat het model ruwweg 1,7 keer zoveel outputtokens gebruikt.

Moet ik Fable 5.1 of Opus 5 gebruiken?

Het advies van Anthropic zelf is om voor het meeste werk met Opus 5 te beginnen. Fable 5.1 wint op kosten pas boven ruwweg 140.000 tot 215.000 gecachete tokens per beurt, en op capaciteit vooral bij lange agentische, onderzoeks- en workflowtaken. Draai eerst een effort-sweep op uw eigen invoer.

Wat is het verschil tussen Fable 5.1 en Mythos 5.1?

Het is hetzelfde model met andere beveiliging. Mythos 5.1 behoudt de volledige cyber- en biologiecapaciteit en is beperkt tot gescreende Amerikaanse organisaties in Anthropic's trusted-access-programma's. Fable 5.1 is de algemeen beschikbare versie.

Wat breekt er als ik van Fable 5 naar Fable 5.1 ga?

Drie API-wijzigingen geven een 400-fout: geforceerde toolkeuze (any of een tool bij naam), thinking-blokken doorgegeven aan eerdere modellen, en bewerkte gespreksgeschiedenis op accounts aangemaakt vanaf 31 augustus 2026. Ook de effort-niveaus moeten opnieuw worden doorgemeten, want de namen betekenen niet hetzelfde tussen modellen.
Onze AI-diensten AI consultant inhuren AI-automatisering AI-agents AI-implementatie Prijzen

Iets hiervan toepassen in uw bedrijf?

Wij maken van deze concepten werkende tools: gegrond, veilig en meetbaar. Begin met een gratis consult.

Gratis consult boeken →