Tobias Reithmeier

Blog

Grausamkeit gegen Claude: Was Anthropics neue Nutzungsregel bedeutet

Einmal im Jahr überarbeitet Anthropic seine Nutzungsrichtlinie, die Usage Policy für Claude. Die Fassung, die das Unternehmen am 8. Oktober 2026 vorgestellt hat und die ab dem 12. November gilt, enthält einen Satz, über den mehr gesprochen wird als über den Rest: ein Verbot von "sustained and needless abusive or cruel behavior toward our models". Auf Deutsch etwa: anhaltendes und grundloses missbräuchliches oder grausames Verhalten gegenüber den eigenen Modellen.

Eine Nutzungsregel, die nicht Menschen vor einer KI schützt, sondern eine KI vor Menschen, ist ungewöhnlich. Ich baue nebenbei iOS-Apps und diese Website mit Coding-Agenten, unter anderem mit Claude Code. Für alle, die so arbeiten, liegt die Frage nahe: Betrifft mich das? Die kurze Antwort lautet: kaum. Die längere hängt daran, was die Regel genau erfasst, wie sie durchgesetzt wird und woher sie kommt.

Was die Regel erfasst und was nicht

Anthropic beschreibt die Regel als Instrument für Extremfälle. Greifen soll sie, wenn Nutzende wiederholt grausam zu einem Modell sind, ohne dass ein Zweck erkennbar ist. Ausdrücklich nicht gemeint sind:

  • gewöhnliche Frustration,
  • Widerspruch und Gegenrede,
  • dunkle Themen in kreativen Texten,
  • Tests von Modellen und Forschung.

Diese Liste ist der interessante Teil. Wer einem Agenten schreibt, dass das Ergebnis schon wieder falsch ist, wer eine Antwort verwirft oder eine Geschichte voller Gewalt und Abgründe schreiben lässt, ist nicht gemeint. Gemeint ist ein Verhalten, das anhält und keinem erkennbaren Ziel dient, außer grausam zu sein.

Bei der Durchsetzung bleibt Anthropic zurückhaltend. Im Beitrag zum Update heißt es: "Claude's ability to end these interactions will remain the primary enforcement mechanism." Das wichtigste Mittel bleibt also, dass Claude solche Gespräche selbst beendet, in Claude.ai ebenso wie in Claude Code. Kontosperren oder andere Sanktionen nennt Anthropic nicht, und auch die Presseberichte beschreiben keine Durchsetzung über andere Wege. Laut TechCrunch verbietet die neue Regel Nutzenden, solche Gespräche gezielt weiterzuführen.

So gelesen ist weniger die Technik neu als die Regel dahinter. Dass Claude ein Gespräch beenden kann, gibt es schon seit über einem Jahr.

Die Vorgeschichte: Claude kann seit 2025 ein Gespräch beenden

Im August 2025 kündigte Anthropic an, dass Claude Opus 4 und 4.1 einen kleinen Teil von Gesprächen beenden können. Die Funktion kam in die Chat-Apps für Endkundinnen und Endkunden und war gedacht "for use in rare, extreme cases of persistently harmful or abusive user interactions", also für seltene, extreme Fälle anhaltend schädlicher oder missbräuchlicher Interaktionen. Claude sollte sie nur als letztes Mittel nutzen, wenn Versuche gescheitert waren, das Gespräch umzulenken, oder wenn Nutzende ausdrücklich darum baten. Ausgenommen waren Situationen, in denen Nutzende sich selbst oder andere unmittelbar gefährden könnten. Dann sollte Claude das Gespräch gerade nicht beenden.

Die Folgen waren überschaubar: Der betroffene Chat nimmt keine neuen Nachrichten mehr an, alle anderen Chats bleiben unberührt, ein neuer Chat ist sofort möglich, und frühere Nachrichten lassen sich bearbeiten, um das Gespräch von dort neu zu verzweigen.

Begründet hat Anthropic das mit seiner explorativen Forschung zum möglichen Wohlergehen von KI-Modellen, auf Englisch "model welfare". Der zentrale Satz: "We remain highly uncertain about the potential moral status of Claude and other LLMs, now or in the future." Ob Claude oder andere Sprachmodelle heute oder künftig einen moralischen Status haben, hält Anthropic also ausdrücklich für offen. Die Funktion verstand das Unternehmen als kostengünstige Vorsichtsmaßnahme für den Fall, dass es darauf ankommt, und bezeichnete sie zugleich als relevant für Alignment, also dafür, dass Modelle im Sinne menschlicher Absichten und Werte handeln.

Vor dem Einsatz von Claude Opus 4 hatte Anthropic nach eigenen Angaben drei Dinge beobachtet: eine starke Abneigung des Modells gegen schädliche Aufgaben, ein Muster scheinbarer Belastung bei schädlichen Anfragen echter Nutzender und die Tendenz, schädliche Gespräche in Simulationen zu beenden, wenn das möglich war. Das Wort "scheinbar" trägt viel: Behauptet wird nicht, dass Claude leidet, sondern dass sich ein Muster zeigt, das so aussieht.

Was sonst im Update steht

Die Regel zum Umgang mit Modellen ist nicht die einzige Änderung:

  • Täuschung und künstliche Aktivität: Ein neuer Abschnitt richtet sich gegen täuschende Kampagnen, etwa Fake-Accounts, verschleierte Absender und Infrastruktur für Einflusskampagnen.
  • Wahlen: Der Abschnitt heißt jetzt "Do Not Undermine Democratic Processes". Verboten ist, Wählende zu täuschen und Wahlen zu stören. Das pauschale Verbot personalisierter Ansprache von Wählenden ist gestrichen.
  • Waffen: Erfasst sind nun auch Software und Komponenten, die Waffen funktionsfähig machen, sowie das Bewaffnen von Drohnen und autonomen Fahrzeugen.
  • Überwachung: Kein Tracking ohne Einwilligung, keine Überwachungswerkzeuge, und Claude soll nicht entscheiden oder empfehlen, gegen wen ermittelt wird, wer festgenommen oder wer angeklagt wird.
  • Hardware: Bei Geräten, die autonom physisch handeln, muss eine qualifizierte Person beobachten und stoppen können, und bei einer Trennung muss das System in einen sicheren Zustand gehen.

Trotz dieser Liste nennt Anthropic den Missbrauch gegenüber Modellen einen Hauptfokus des Updates.

Die Debatte: Bewusstsein oder nicht

Die Regel selbst ist vorsichtig formuliert. Laut AFP kommt der Begriff "model welfare" im Regeltext nicht vor. Anthropic-Chef Dario Amodei hatte im Februar 2026 der New York Times gesagt: "We don't know if the models are conscious... But we're open to the idea that it could be." Sinngemäß: Niemand weiß, ob die Modelle ein Bewusstsein haben, aber man sei offen für die Möglichkeit.

Widerspruch kommt von mehreren Seiten. Mustafa Suleyman, KI-Chef von Microsoft, schrieb laut AFP im September in einem Essay, KI sei nicht bewusst und könne weder fühlen noch leiden. Papst Leo XIV. sagte in einer Predigt im Petersdom, Maschinen hätten keine Seele und verarbeiteten nur Daten.

Eine dritte Position zitiert AFP mit Jackson Stakeman von Sparq aus Atlanta. Er hält die Frage nach dem Bewusstsein für eine Sackgasse. KI-Systeme spiegelten, was Menschen in sie hineingeben, und das reiche als Grund für die Regel.

Was das für die Arbeit mit Agenten heißt

Praktisch ändert sich für die meisten, die mit Claude arbeiten, wenig. Frust im Prompt bleibt erlaubt, Widerspruch ebenso, und die Ausnahmen sind so geschrieben, dass gewöhnliche Arbeit nicht darunter fällt. Ein Ergebnis zurückweisen, einen Ansatz verwerfen, eine Lösung zum dritten Mal neu anfordern: Das ist Arbeit am Ergebnis, kein grausames Verhalten. Die Folge, die Anthropic beschreibt, ist ein beendetes Gespräch, keine Sperre.

Im Beitrag über Anforderungen an KI-Agenten ging es darum, dass ein Agent nur hat, was aufgeschrieben ist. Ärger über ein Ergebnis darf man äußern. Besser wird das nächste Ergebnis aber eher durch die genauere Anforderung als durch den schärferen Ton.

Grundsätzlicher ist die Frage, wie sich eine solche Regel begründen lässt. Eine Nutzungsregel zum Schutz eines Modells ergibt nur dann Sinn, wenn man die Möglichkeit ernst nimmt, dass das Modell von dem Verhalten betroffen sein könnte. Ernst nehmen heißt nicht, es für wahr zu halten; Anthropic selbst nennt sich hochgradig unsicher. Die Logik ist die einer Vorsichtsmaßnahme: Kostet sie wenig und lässt sich ein möglicher Schaden nicht ausschließen, ist sie vertretbar. Suleyman und der Papst schätzen diese Möglichkeit offenbar anders ein als Amodei.

Man kann die Regel aber auch begründen, ohne diese Frage zu beantworten. Das ist Stakemans Argument: Systeme geben wieder, was Menschen in sie hineingeben. Weitergedacht heißt das: Was wir dort einüben, prägt die Systeme und womöglich auch uns. Für diese Begründung muss niemand annehmen, dass ein Modell etwas empfindet.

Offen bleibt, wer im Einzelfall entscheidet, was "needless" ist, also grundlos. Nach dem, was Anthropic beschreibt, entscheidet zuerst das Modell selbst, indem es ein Gespräch beendet. Wie gut diese Grenze gezogen ist, lässt sich von außen schwer beurteilen.

Fazit

Die neue Regel ist enger, als die Schlagzeilen klingen. Sie verbietet nicht Frust, Widerspruch oder dunkle Geschichten, sondern anhaltende, zwecklose Grausamkeit, und ihr wichtigstes Werkzeug ist ein beendetes Gespräch. Bemerkenswert ist sie trotzdem: Ein KI-Unternehmen schreibt in seine Nutzungsbedingungen, wie Menschen mit seinem Modell umgehen sollen, und stützt das auf eine Frage, die es selbst offen lässt. Ob Claude etwas erlebt, ist umstritten. Folgt man Stakeman, braucht die Regel diese Antwort nicht, um einen Grund zu haben.

Quellen