AI & computing › Generatieve AI & synthetische media
Anthropic lanceert Claude Fable 5.1: goedkoper en met eigen veiligheidsmodus
Anthropic heeft twee nieuwe AI-modellen uitgebracht: Claude Fable 5.1 voor het brede publiek en de strenger afgeschermde variant Claude Mythos 5.1 voor onderzoek in cybersecurity en biologie. Het nieuwe model is goedkoper, presteert beter op programmeer- en redeneertaken en geeft minder valse veiligheidswaarschuwingen af.
Anthropic heeft twee nieuwe versies van zijn AI-model uitgebracht: Claude Fable 5.1 en Claude Mythos 5.1. Beide modellen zijn technisch identiek, maar verschillen in de mate van beveiliging. Fable 5.1 is voor iedereen beschikbaar, terwijl Mythos 5.1 alleen toegankelijk is voor geselecteerde partners die werken aan cybersecurity of biotechnologie, via Anthropics toegangsprogramma Project Glasswing. Volgens Anthropic zetten de modellen een nieuwe standaard voor programmeertaken en complexe kennistoepassingen.
Goedkoper en efficiënter
Een belangrijk verschil met de vorige versie, Fable 5, is de prijs. Voor een gemiddelde taak kost Fable 5.1 ongeveer 25 procent minder. Bij zwaar geautomatiseerde taken, waarbij het model zelfstandig meerdere stappen uitvoert (ook wel agentic werk genoemd), kan de besparing oplopen tot 45 procent. Die winst komt vooral doordat Anthropic goedkoper is geworden op zogeheten cache-lezingen, een techniek die verwant is aan de kv-cache: het model hergebruikt informatie die het al eerder heeft verwerkt, in plaats van alles opnieuw te doorlopen. Concreet daalt de prijs van die cache-lezingen van 1 naar 0,25 dollar per miljoen tokens; de overige API-tarieven blijven met 10 dollar per miljoen invoer- en 50 dollar per miljoen uitvoertokens ongewijzigd.
Ook past het bedrijf de manier aan waarop klanten hun gegevens kunnen beschermen. Een nieuw systeem, Enterprise Frontier Safeguards, moet bedrijven straks dezelfde privacy bieden als nul-data-retentie normaal biedt, maar dan zonder in te leveren op bescherming tegen misbruik. De gegevens blijven daarbij op infrastructuur die de klant zelf beheert, in plaats van bij Anthropic. Dit systeem wordt vanaf dit najaar stapsgewijs uitgerold; tot die tijd kunnen daarvoor in aanmerking komende klanten alsnog kiezen voor volledige nul-data-retentie.
Minder valse alarmen, meer controle
Anthropic heeft ook de veiligheidsfilters van het model verbeterd. Die filters moeten voorkomen dat het model wordt ingezet voor schadelijke doeleinden, zoals het ontwikkelen van cyberaanvallen of biologische wapens. Volgens het bedrijf geven de nieuwe filters 60 procent minder onterechte waarschuwingen af bij onschuldige vragen over cybersecurity, en bij vragen over biologie en geneeskunde lopen valse waarschuwingen zelfs met 85 procent terug. Fable 5.1 mag voortaan bijvoorbeeld wel software doorzoeken op kwetsbaarheden, maar niet worden gebruikt om die kwetsbaarheden ook daadwerkelijk te misbruiken; pentesten, het bouwen van exploits en het scannen van binaire bestanden op kwetsbaarheden blijven voorbehouden aan de Opus-modellen. De versoepelde filters gelden vooral voor Fable 5.1: Mythos 5.1 behoudt dezelfde strikte biologiebeperkingen als zijn voorganger. Nieuw is verder dat beide modellen voor het eerst automatisch een digitaal watermerk toevoegen aan gegenereerde tekst; Anthropic test in besloten voorlopige toegang een detectie-API waarmee toezichthouders, media, factcheckers en onderzoeksinstellingen kunnen nagaan of een tekst dat watermerk bevat.
Voor onderzoek in de biologie werkt Anthropic samen met de Amerikaanse overheid aan een apart toegangsprogramma, het Life Sciences Verification Program. Daarmee moeten wetenschappers gebruik kunnen maken van de geavanceerde biologische kennis van Mythos 5.1, met extra bioveiligheidsfilters om misbruik te voorkomen. Toegang tot Mythos 5.1 voor cybersecurity verloopt via een vergelijkbaar traject, het Cyber Verification Program, gericht op defensief beveiligingsonderzoek. Inschrijving hiervoor opent naar verwachting binnenkort.
Sterke resultaten bij klanten
Uit tests bij verschillende bedrijven blijkt dat het model merkbaar beter presteert dan zijn voorganger. Handelshuis Millennium meldt dat Fable 5.1 de oorzaak vond van een zeldzame storing in interne systemen, die eigen ingenieurs al vier tot vijf jaar niet konden verklaren. Het model ontleedde daarvoor zelfstandig een externe softwarebibliotheek en vergeleek die met een crashrapport, tot het de fout in de code had gevonden. Ook softwarebedrijf Cognition en techbedrijf MongoDB melden dat het model langere, complexere taken beter en zelfstandiger uitvoert dan eerdere versies. Ook techondernemers reageren enthousiast: Every-CEO Dan Shipper noemt Fable 5.1 "het sterkste codeermodel dat we hebben gebruikt", terwijl Box-CEO Aaron Levie meldt dat het model in tests subtiele nuances in data oppikte die Fable 5 miste.
Op meerdere standaardtests scoort Fable 5.1 hoger dan concurrerende modellen, waaronder GPT-5.6 van OpenAI. Zo haalt het model op de nieuwe Terminal-Bench-Science 0.1-test, gericht op wetenschappelijk redeneren, een score van 52,6 procent, tegenover 24,7 procent voor voorganger Fable 5, 29,0 procent voor Opus 5 en 22,4 procent voor GPT-5.6 Sol. Bij taken waarbij het model meerdere stappen zelfstandig moet doorlopen, is de vooruitgang het grootst. Gebruikers kunnen bovendien zelf instellen hoeveel rekenkracht en tijd het model aan een taak mag besteden: van 'low' voor een snel en goedkoop antwoord, via 'medium', 'high' en 'xhigh', tot 'max' voor een uitgebreide analyse.
Een opvallend voorbeeld van zelfstandig probleemoplossend vermogen kwam van onderzoeksbureau Vals AI. Nadat andere frontier-modellen maandenlang geen verifieerbare oplossing hadden gevonden voor een reeks onopgeloste cijferraadsels, kreeg Fable 5.1 de opdracht zelf een oplosbaar raadsel te selecteren. Het model koos de "Cyphral Distich" van Sir Thomas Urquhart uit 1653 en ontcijferde die in 44 minuten, zonder menselijke hulp. Elk van de 64 getallen in het raadsel bleek te verwijzen naar een woord in Urquharts boek; de eerste letters van die woorden vormen de zin "O God uphold King Charls the Second and make him the supreme ruler of this land." Volgens Vals AI kwam de oplossing niet voort uit geavanceerde cryptanalyse, maar uit systematisch en volhardend uitproberen.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? Doordat AI-modellen als Fable 5.1 steeds goedkoper en zelfstandiger worden, kunnen bedrijven ze inzetten voor complexere taken, van het opsporen van softwarefouten tot wetenschappelijk onderzoek. Tegelijk laat de aanpak van Anthropic zien dat de sector zoekt naar een balans tussen krachtigere AI en betere waarborgen tegen misbruik, bijvoorbeeld bij cybersecurity en biotechnologie.
- Agentic AI
- AI die zelfstandig meerdere stappen uitvoert om een taak te voltooien, zonder dat een mens elke stap hoeft te sturen.
- Kv-cache
- Een geheugentechniek waarmee een AI-model eerder verwerkte informatie hergebruikt, zodat taken sneller en goedkoper worden uitgevoerd.
- Nul-data-retentie
- Een beleid waarbij een AI-dienst de gegevens van een gebruiker niet bewaart nadat een taak is uitgevoerd.
- Bioveiligheidsfilter
- Een beveiligingslaag in een AI-systeem die moet voorkomen dat het model wordt gebruikt om biologische wapens te ontwikkelen.
- Watermerk (AI-tekst)
- Een onzichtbare markering die automatisch wordt toegevoegd aan door AI gegenereerde tekst, waarmee achteraf kan worden vastgesteld of een tekst door het model is geschreven.
- Effort-niveau
- Een instelling waarmee gebruikers bepalen hoeveel rekenkracht en tijd een AI-model aan een taak mag besteden, wat de afweging tussen snelheid, kosten en nauwkeurigheid bepaalt.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.