---
title: "Claude Fable 5.1 is uit: minder weigeringen, lagere prijs"
date: 2026-09-01
author: "Daan Koster"
featured_image: "https://watisai.nl/wp-content/uploads/2026/09/fable51-hero.jpg"
categories:
  - name: "AI nieuws"
    url: "/category/ai-nieuws.md"
---

# Claude Fable 5.1 is uit: minder weigeringen, lagere prijs

Je vraagt een AI-chatbot hoe een doodgewone pijnstiller werkt en krijgt een preek terug: daar kan hij helaas niet bij helpen, raadpleeg een arts. Iedereen die vaak met Claude werkt, kent dat moment. Anthropic zegt nu dat precies die ergernis grotendeels weg is.

Het bedrijf lanceerde op 1 september Claude Fable 5.1 en Claude Mythos 5.1, via een [thread van acht tweets op X](https://x.com/claudeai/status/2094848572143407483). Fable 5.1 staat per direct voor iedereen aan. Mythos 5.1 niet: dat model is alleen beschikbaar voor cyberverdedigers en levenswetenschappers via speciale toegangsprogramma’s.

## Dit belooft Anthropic met Fable 5.1

- Betere prestaties op lange, complexe taken en onderzoekswerk.
- Op de benchmark Terminal-Bench 4.0: 55,8% tegen 42,0% voor Fable 5. Op het gloednieuwe Terminal-Bench-Science 0.1: 52,6%, ruim het dubbele van Fable 5.
- Cache reads (het opnieuw inlezen van eerdere context) worden 75% goedkoper. In de praktijk scheelt dat volgens Anthropic zo’n 25% op de totale kosten, tot 45% bij zwaar automatisch gebruik.
- De veiligheidsfilters slaan zo’n 60% minder vaak aan op onschuldige cybersecurity-vragen. Bij basale biologie- en medische vragen weigert het model ongeveer 85% minder vaak.

Alle cijfers komen van Anthropic zelf. Onafhankelijke tests waren er op lanceerdag nog niet.

## Een verdubbeling op een benchmark van versie 0.1 zegt weinig

Die 52,6% op Terminal-Bench-Science klinkt spectaculair, tot je het versienummer ziet: 0.1. Een splinternieuwe test waarop je eigen nieuwe model je eigen oude model verslaat, is geen onafhankelijke meting. De sprong op Terminal-Bench 4.0 is serieuzer, want die benchmark bestaat langer en wordt door meer partijen gebruikt.

Voor de meeste mensen maakt dat benchmarkgeweld weinig uit. Wat je thuis merkt is iets anders: het model weigert minder vaak.

## Minder vaak “daar kan ik niet bij helpen”

Die 85% minder weigeringen op basale gezondheids- en biologievragen is voor gewone gebruikers de grootste verandering. Een AI die een normale vraag over paracetamol afkapt, leert je niets en stuurt je terug naar Google. Dat Anthropic dit terugdraait is winst, en het is eerlijk dat ze de cijfers erbij geven.

Eén kanttekening hoort erbij: minder weigeren betekent niet dat de antwoorden kloppen. Een model dat vaker antwoordt, kan ook vaker fout antwoorden. Blijf medische informatie checken bij een echte bron, zoals apotheek.nl of je huisarts. Het model is een startpunt, geen eindstation.

De concurrentiestrijd om wie welk model mag gebruiken wordt intussen grimmiger, zoals ook bleek toen [OpenAI de modeltoegang van Cursor afsloot](https://watisai.nl/openai-stopt-modeltoegang-cursor/). Anthropic kiest hier de omgekeerde route: Fable 5.1 overal direct beschikbaar, en alleen het gespecialiseerde Mythos-model achter een hek.

## Probeer de vraag die eerder werd geweigerd

Heb je ooit een normale vraag gesteld die Claude weigerde te beantwoorden? Stel hem vanavond opnieuw. Dan weet je binnen een minuut of die 85% ook voor jouw soort vragen geldt, of alleen voor de voorbeelden uit het persbericht.

Dit najaar rolt Anthropic ook Enterprise Frontier Safeguards uit, een privacylaag voor bedrijven. Tegen die tijd zijn er ook onafhankelijke benchmarkresultaten. Vallen die lager uit dan de eigen cijfers van Anthropic, dan weet je wat het persbericht waard was.