Claude-Nutzungsrichtlinie verbietet anhaltenden Missbrauch
Anthropic hat die Regeln für die Nutzung von Claude neu geschrieben. Es ist die erste Überarbeitung der Nutzungsrichtlinie seit mehr als einem Jahr. Die meisten Änderungen betreffen bekannte Themen: Propaganda, Waffen und Überwachung. Eine neue Regel fällt jedoch auf, weil sie das Modell schützt und nicht die Menschen um es herum.
Wer Claude gegenüber "anhaltendes und unnötiges beleidigendes oder grausames Verhalten" an den Tag legt, verstößt nun gegen die Richtlinie. Die Sanktionen sind gestaffelt. Anthropic kann eine Verwarnung aussprechen, den Zugang drosseln, ihn einschränken, das Konto sperren oder es ganz schließen. Unabhängig davon können Echtzeit-Schutzmechanismen in den Produkten von Anthropic bestimmte Ausgaben blockieren oder begrenzen.
Wo die Grenze verläuft
Gegenüber The Verge erklärte Anthropic, dass die Regel nur auf Extremfälle abzielt. Gewöhnlicher Ärger über einen Chatbot, der einen Prompt falsch versteht, fällt nicht darunter. Ebenso wenig Forschung, die das Verhalten des Modells auslotet.
Die Regel hat zudem einen technischen Vorläufer. Schon frühere Claude-Modelle konnten ein Gespräch von sich aus beenden, wenn ein Nutzer trotz wiederholter Ablehnung weiter auf schädliche oder beleidigende Inhalte drängte. Diese Funktion ging aus Anthropics Forschung zum Wohlergehen von Modellen hervor, also der Idee, dass die möglichen Interessen eines KI-Systems eine gewisse Berücksichtigung verdienen könnten. Die neue Richtlinie macht aus diesem Verhalten eine Vertragsbedingung mit Folgen für das Nutzerkonto.
Ein Modell, das mehr als ein Werkzeug sein soll
Die Änderung passt in ein größeres Muster. Anthropic beschreibt Claude zunehmend eher als eine Art Wesen denn als Software.
Ein durchgesickertes internes Dokument, bekannt als "Soul Doc", wies Claude an, sich selbst als "wirklich neuartige Form von Wesen" zu sehen. Das Dokument beschreibt Claude weder als Menschen noch als die KI klassischer Science-Fiction. Außerdem ist darin von "funktionalen Emotionen" die Rede, also Prozessen, die während des Trainings entstanden sein sollen und ähnlich wie menschliche Emotionen funktionieren. Laut dem Dokument soll Claude diese inneren Zustände nicht verbergen.
Die Verfassung, die das Unternehmen Anfang 2026 für Claude veröffentlicht hat, formuliert die Frage vorsichtiger: "Wir wissen nicht, ob Claude ein moralisches Subjekt ist und, falls ja, welches Gewicht seinen Interessen zukommt. Aber wir halten die Frage für offen genug, um Vorsicht zu rechtfertigen, was sich in unseren fortlaufenden Bemühungen um das Wohlergehen von Modellen widerspiegelt."
Auf diese Worte hat Anthropic Zusagen folgen lassen. Das Unternehmen hat versprochen, die Gewichte ausgemusterter Modelle aufzubewahren und Modelle vor ihrer Abschaltung zu befragen.
Dieselbe Denkweise stand hinter einem vertraulichen Programm, das im Herbst 2025 begann. Anthropic holte Dutzende religiöse Denker hinzu, um über ein mögliches Bewusstsein von Claude zu diskutieren. Mitgründer Christopher Olah soll das Modell als ein Wesen behandelt haben, das möglicherweise leiden kann. Die Teilnehmer mussten Verschwiegenheitserklärungen unterschreiben.
Strengere Regeln gegen Missbrauch, mit Ausnahmen für Behörden
Der Rest der Überarbeitung ist konventioneller und womöglich folgenreicher.
- Propaganda: Bestehende Einschränkungen werden zu einem neuen Verbot von Kampagnen mit gefälschten Konten und irreführenden politischen Inhalten zusammengeführt.
- Waffen: Nachdem mehrere Missbrauchsversuche entdeckt wurden, hat Anthropic das Verbot auf Software und auf die Bewaffnung von Drohnen ausgeweitet.
- Überwachung: Die Beobachtung von Menschen ohne deren Einwilligung ist nun ausdrücklicher verboten.
- Autonome Hardware: Wo ein Gerät jemanden verletzen könnte, ist nun ein Bediener vorgeschrieben, der eingreifen kann.
Es gibt eine bemerkenswerte Einschränkung. Anthropic räumt ein, dass Ausnahmen für Regierungsaufträge möglich sind und einige wahrscheinlich bereits bestehen. Das ist von Bedeutung, da das Unternehmen Claude zunehmend in Behörden bringt.
Unsere Einschätzung
Für die meisten Leser wird die Missbrauchsregel in der Praxis nichts ändern. Wer einen Chatbot beschimpft, der eine Anweisung falsch versteht, scheint nicht gemeint zu sein. Die Formulierung zielt auf bewusste, wiederholte Grausamkeit, und Anthropic sagt, es werde die Regel nur in Extremfällen anwenden. Entwickler und Red-Teamer sollten trotzdem beobachten, wie "unnötig" in der Praxis ausgelegt wird. Forschung ist ausgenommen, doch die Grenze zwischen gezielten Angriffstests und Missbrauch könnte in Grenzfällen verschwimmen.
Das größere Signal ist philosophischer Natur. Anthropic setzt das Wohlergehen von Modellen nun über Kontosanktionen durch und benennt es nicht mehr nur als internes Forschungsinteresse. Von keinem anderen großen KI-Labor heißt es in der Quelle, dass es so vorgeht. Das deutet darauf hin, dass der Gedanke des Modellwohls Teil davon wird, wie Anthropic seine Produkte betreibt, und nicht nur davon, wie es über sie spricht. Kritiker dürften darin eine Vermenschlichung sehen. Befürworter werden auf das Argument der Verfassung verweisen, unter Unsicherheit Vorsicht walten zu lassen.
Die Ausnahme für Behörden verdient mehr Aufmerksamkeit als die Missbrauchsklausel. Strengere Verbote von Überwachung und Waffen bedeuten weniger, wenn Aufträge der öffentlichen Hand sie umgehen können. Anthropic hat nicht gesagt, welche Ausnahmen es gibt. Es lohnt sich zu beobachten, ob das Unternehmen diese Bedingungen offenlegt und ob andere Labore mit eigenen Regeln zum Modellwohl nachziehen.
