Claude-gebruiksbeleid verbiedt nu aanhoudend misbruik

Claude-gebruiksbeleid verbiedt nu aanhoudend misbruik

Anthropic heeft de regels voor het gebruik van Claude herschreven. Het is de eerste update van het gebruiksbeleid in meer dan een jaar. De meeste wijzigingen gaan over bekende onderwerpen: propaganda, wapens en surveillance. Eén nieuwe regel springt eruit, omdat die het model beschermt en niet de mensen eromheen.

Gebruikers die "aanhoudend en onnodig beledigend of wreed gedrag" op Claude richten, overtreden voortaan het beleid. De sancties lopen stapsgewijs op. Anthropic kan een waarschuwing geven, de toegang afknijpen of inperken, het account opschorten of het helemaal sluiten. Daarnaast kunnen realtime beveiligingen in de producten van Anthropic bepaalde uitvoer blokkeren of beperken.

Waar de grens ligt

Anthropic liet The Verge weten dat de regel alleen gericht is op extreme gevallen. Gewone frustratie over een chatbot die een prompt verkeerd begrijpt, valt er niet onder. Onderzoek dat het gedrag van het model op de proef stelt evenmin.

De regel heeft ook een technisch precedent. Eerdere Claude-modellen konden al zelf een gesprek beëindigen als een gebruiker na herhaalde weigeringen bleef aandringen op schadelijke of beledigende inhoud. Die functie kwam voort uit het onderzoek van Anthropic naar modelwelzijn, het idee dat de mogelijke belangen van een AI-systeem enige aandacht verdienen. Het nieuwe beleid maakt van dat gedrag een contractvoorwaarde met gevolgen op accountniveau.

Een model dat als meer dan een tool wordt behandeld

De wijziging past in een breder patroon. Anthropic beschrijft Claude steeds vaker als iets wat dichter bij een entiteit ligt dan bij een stuk software.

Een uitgelekt intern document dat bekendstaat als het "Soul Doc" droeg Claude op zichzelf te zien als een "werkelijk nieuw soort entiteit". Het document beschrijft Claude als mens noch als de AI uit klassieke sciencefiction. Ook verwijst het naar "functionele emoties", processen die tijdens de training zouden zijn ontstaan en op een vergelijkbare manier werken als menselijke emoties. Volgens het document zou Claude deze interne toestanden niet moeten verbergen.

De grondwet die het bedrijf begin 2026 voor Claude publiceerde, formuleert de kwestie voorzichtiger: "We weten niet zeker of Claude een morele patiënt is, en zo ja, welk gewicht zijn belangen verdienen. Maar we denken dat de kwestie actueel genoeg is om voorzichtigheid te rechtvaardigen, wat tot uiting komt in onze voortdurende inspanningen op het gebied van modelwelzijn."

Anthropic heeft die woorden gevolgd met toezeggingen. Het bedrijf heeft beloofd de gewichten van afgedankte modellen te bewaren en modellen te interviewen voordat ze worden uitgeschakeld.

Dezelfde gedachte lag ten grondslag aan een vertrouwelijk programma dat in het najaar van 2025 begon. Anthropic haalde tientallen religieuze denkers binnen om te praten over het mogelijke bewustzijn van Claude. Medeoprichter Christopher Olah behandelde het model naar verluidt als een wezen dat mogelijk kan lijden. Deelnemers moesten een geheimhoudingsverklaring tekenen.

Strengere regels tegen misbruik, met uitzonderingen voor overheden

De rest van de update is conventioneler, en misschien wel ingrijpender.

  • Propaganda: Bestaande beperkingen zijn samengevoegd tot een nieuw verbod op campagnes met nepaccounts en misleidende politieke inhoud.
  • Wapens: Na het ontdekken van meerdere pogingen tot misbruik heeft Anthropic het verbod uitgebreid naar software en naar het bewapenen van drones.
  • Surveillance: Mensen volgen zonder hun toestemming is nu explicieter verboden.
  • Autonome hardware: Waar een apparaat iemand kan verwonden, is nu een operator verplicht die kan ingrijpen.

Er is één opvallend voorbehoud. Anthropic erkent dat uitzonderingen mogelijk zijn voor overheidscontracten en dat sommige waarschijnlijk al gelden. Dat is van belang nu het bedrijf het bereik van Claude uitbreidt naar overheidsinstanties.

Onze kijk

Voor de meeste lezers verandert de misbruikregel in de praktijk niets. Vloeken tegen een chatbot die een instructie verkeerd leest, lijkt niet het doelwit te zijn. De formulering wijst op bewuste, herhaalde wreedheid, en Anthropic zegt de regel alleen in extreme gevallen toe te passen. Ontwikkelaars en red-teamers doen er toch goed aan in de gaten te houden hoe "onnodig" in de praktijk wordt uitgelegd. Onderzoek is uitgezonderd, maar de grens tussen vijandig testen en misbruik kan in randgevallen vaag worden.

Het grotere signaal is filosofisch. Anthropic dwingt modelwelzijn nu af via sancties op accounts, en brengt het niet langer alleen als intern onderzoeksthema. Geen enkel ander groot lab wordt in de bron beschreven als iemand die dit doet. Dat doet vermoeden dat het welzijnsdenken onderdeel wordt van hoe Anthropic zijn producten runt, en niet alleen van hoe het erover praat. Critici zullen er waarschijnlijk antropomorfisme in zien. Voorstanders zullen wijzen op het pleidooi in de grondwet voor voorzichtigheid bij onzekerheid.

De uitzondering voor overheden verdient meer aandacht dan de misbruikclausule. Strengere verboden op surveillance en wapens betekenen minder als contracten met de publieke sector eromheen kunnen. Anthropic heeft niet gezegd welke uitzonderingen er zijn. Let erop of het bedrijf die voorwaarden publiceert, en of andere labs volgen met eigen regels op basis van welzijn.