AI & computing › Generatieve AI & synthetische media

Anthropic blokkeert pogingen om AI-model Claude in te zetten voor biowapens

· Bijgewerkt 11 september 2026, 11:13 · 2 min leestijd

Generatieve AI & synthetische media
Beeld: Hacker News frontpage

AI-bedrijf Anthropic heeft de afgelopen maanden meerdere pogingen tegengehouden om zijn chatbot Claude te misbruiken voor het ontwikkelen van biologische wapens. Dat blijkt uit een dreigingsrapport dat het bedrijf donderdag publiceerde, waarin ook cyberspionage, propaganda en fraude met Claude aan bod komen.

Anthropic, de maker van de AI-chatbot Claude, meldt in een nieuw dreigingsrapport dat het tussen december 2025 en augustus 2026 tientallen gevallen van misbruik heeft opgespoord en gestopt. Vijf daarvan betroffen personen die Claude gebruikten op een manier die kon bijdragen aan de ontwikkeling van biologische wapens. Het bedrijf noemt dit "een van de ernstigste risico's" van geavanceerde large language models: dezelfde kennis die nodig is om een ziekteverwekker te bestrijden, kan in theorie ook worden gebruikt om er een te maken.

Niet alleen Anthropic ziet risico's

Anthropic is niet het enige bedrijf dat hiermee worstelt. Ook Google meldde deze week dat iemand via zijn AI-tool Gemini probeerde een volledige, stap-voor-stap handleiding te krijgen voor het maken van biologische wapens. Grote AI-bedrijven bouwen daarom bioveiligheidsfilters in hun modellen in, die verdachte vragen moeten herkennen en blokkeren. Jacob Klein, hoofd dreigingsonderzoek bij Anthropic, noemt de praktijk genuanceerder dan mensen vaak denken: het gaat zelden om iemand die openlijk zegt een wapen te willen bouwen, maar om subtielere pogingen om gevoelige technische kennis los te peuteren.

Het rapport beschrijft daarnaast een reeks andere misbruikgevallen. Zo zou een hackgroep die banden heeft met de Russische cyberspionagecampagne Midnight Blizzard, Claude hebben ingezet om malware automatisch te herschrijven zodra beveiligingssoftware die detecteerde. Een Iraanse propaganda-instelling gebruikte het model voor desinformatie, en de hackgroep ShinyHunters wordt genoemd als actieve misbruiker. Ook meldt Anthropic zes gevallen waarin Claude werd gebruikt om software te ontwikkelen voor conventionele wapens, zoals vuurwapens, raketten, drones en bommen, inclusief de besturingssystemen daarvan.

Chinese labs en groeiende zorgen

Opvallend is dat Anthropic ook Chinese AI-bedrijven beschuldigt van pogingen om de mogelijkheden van Claude te kopiëren via distillatie, een techniek waarbij een kleiner AI-model traint op de output van een groter, duurder model. Volgens het bedrijf ging het om één zo'n geval bij zijn krachtigste, nog niet breed beschikbare modellen.

Het rapport verschijnt te midden van toenemende onrust over de risico's van AI. Een topveiligheidsonderzoeker van Anthropic waarschuwde eerder dat er meer dan tien procent kans is dat AI binnen tien jaar "alle mensen zou kunnen doden". OpenAI-topwetenschapper Jakub Pachocki riep de sector op tot vrijwillige vertraging in de ontwikkeling. In de Verenigde Staten diende senator Bernie Sanders wetgeving in om zogeheten AI-superintelligentie te verbieden en de ontwikkeling van geavanceerde AI tijdelijk stil te leggen. Anthropic zegt zijn bevindingen te hebben gedeeld met autoriteiten en partners in de sector, en de inzichten te gebruiken om toekomstig misbruik sneller te herkennen.

Achtergrond & begrippen

Wat betekent dit voor de toekomst? Dit nieuws laat zien dat AI-bedrijven steeds vaker moeten optreden als poortwachter tegen misbruik van hun eigen technologie, van biowapens tot cyberaanvallen. Naarmate AI-modellen krachtiger worden, groeit ook de roep om internationale afspraken en vertraging in de ontwikkeling om de risico's beheersbaar te houden.

Large language model
Een AI-systeem dat is getraind op enorme hoeveelheden tekst en daardoor mensachtige taal kan begrijpen en genereren, zoals Claude, ChatGPT en Gemini.
Bioveiligheidsfilter
Een beveiligingsmaatregel in AI-modellen die probeert te herkennen en te blokkeren wanneer gebruikers vragen stellen die kunnen bijdragen aan het ontwikkelen van biologische wapens.
Distillatie
Een techniek waarbij een kleiner, goedkoper AI-model traint op de antwoorden van een groter model, om zo diens vaardigheden te kopiëren.
Superintelligentie
Een hypothetische vorm van kunstmatige intelligentie die op vrijwel alle vlakken slimmer is dan de mens, en waarover onder meer senator Bernie Sanders zijn zorgen uitte.
Threat intelligence
Onderzoek en analyse waarmee organisaties dreigingen, zoals misbruik van hun technologie, proberen te herkennen en te voorkomen.

Bronnen

Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.

Meer over Generatieve AI & synthetische media