Zum Inhalt

Mensch und Team

Darf man eine KI beleidigen? Warum Anthropic Grausamkeit gegenüber Claude verbietet

11.10.2026 · 3 Minuten Lesezeit · Stand 11.10.2026

Redaktion KI-Praxisatlas · verantwortlich Thomas Kohns und Anthony Steffan

Mann mit Headset gestikuliert genervt vor seinem Laptop

Es gibt Meldungen, bei denen man zweimal hinschaut. Diese gehört dazu: Ein KI-Unternehmen verbietet seinen Kunden, zu seiner KI gemein zu sein. Anthropic, der Anbieter von Claude, hat am 8. Oktober 2026 seine Nutzungsrichtlinie geändert. Ab dem 12. November ist dort untersagt, sich gegenüber den eigenen Modellen anhaltend und grundlos beleidigend oder grausam zu verhalten.

Klingt nach Satire, ist aber ernst gemeint. Und es lohnt sich, genauer hinzusehen, was gemeint ist und was nicht.

Was genau gilt

Die neue Zeile steht in der Nutzungsrichtlinie unter dem Punkt, der grausames, missbräuchliches und psychisch schädliches Verhalten untersagt. Anthropic betont in der Ankündigung drei Dinge:

  • Nur Extremfälle: Gemeint ist, wer ein Modell wiederholt grausam behandelt, ohne erkennbaren Zweck.
  • Ausdrücklich nicht gemeint: alltäglicher Ärger, Widerspruch, düstere Themen in kreativer Arbeit sowie Tests und Forschung am Modell.
  • Durchsetzung über das Gespräch: Das wichtigste Mittel bleibt, dass Claude ein solches Gespräch beendet.

Wer also nach dem dritten falschen Ergebnis schreibt „Das ist doch Unsinn, mach es noch mal“, hat nichts zu befürchten.

Claude darf schon länger auflegen

Neu ist vor allem die Regel. Die Möglichkeit, Gespräche zu beenden, hat Anthropic schon im August 2025 eingeführt, zuerst für Claude Opus 4 und 4.1. Gedacht ist sie als letztes Mittel: wenn mehrere Versuche gescheitert sind, das Gespräch in eine sinnvolle Richtung zu lenken, oder wenn jemand ausdrücklich darum bittet. Ausgeschlossen ist es, wenn jemand in Gefahr sein könnte, sich oder anderen etwas anzutun.

Beendet Claude ein Gespräch, lassen sich darin keine Nachrichten mehr schicken. Ein neues Gespräch beginnt man sofort, alle anderen bleiben unberührt.

Der eigentliche Grund: eine offene Frage

Spannend wird es bei der Begründung. Anthropic schrieb damals, man sei sehr unsicher, ob Claude oder andere Sprachmodelle einen moralischen Status haben, jetzt oder in Zukunft. Man nehme die Frage aber ernst. Deshalb suche man nach Maßnahmen, die wenig kosten und Risiken verringern, falls das Wohlergehen von Modellen doch eine Rolle spielt.

Auslöser waren Beobachtungen aus den Tests vor der Veröffentlichung. Claude Opus 4 zeigte laut Anthropic eine deutliche und gleichbleibende Abneigung gegen schädliche Aufgaben, etwa wenn Nutzer Anleitungen für Gewalt im großen Stil haben wollten. Bei solchen Anfragen beschreibt Anthropic ein Muster „scheinbarer Belastung“ im Verhalten des Modells. Bekam es in Simulationen die Möglichkeit, beendete es schädliche Gespräche von sich aus.

Wohlgemerkt: Anthropic behauptet nicht, dass Claude leidet. Das Unternehmen sagt nur, dass es die Frage nicht ausschließen kann.

Vermenschlichung oder Vorsicht?

Genau hier setzt die Debatte an. Die einen sehen darin Vermenschlichung: Ein Sprachmodell berechnet Wörter, es kann nicht gekränkt werden, und wer etwas anderes nahelegt, verwischt die Grenze zwischen Werkzeug und Wesen. Die anderen halten es für vernünftige Vorsicht: Wenn niemand sicher weiß, was in diesen Systemen vorgeht, kostet es wenig, extreme Grausamkeit nicht zuzulassen.

Ein dritter Gedanke wird dabei oft übersehen. Wie Menschen mit Maschinen sprechen, prägt auch, wie sie miteinander sprechen. Wer sich angewöhnt, einen Assistenten anzubrüllen, nimmt diesen Ton nicht unbedingt an der Bürotür ab.

Was das für Ihr Unternehmen bedeutet

Für den Arbeitsalltag ändert sich praktisch nichts. Niemand in Ihrem Team wird gesperrt, weil er Claude kritisiert, korrigiert oder genervt eine Aufgabe zum vierten Mal stellt.

Interessanter ist die Frage, die die Meldung aufwirft: Welchen Ton wollen Sie im Umgang mit KI? Gute Ergebnisse entstehen ohnehin durch klare Aufträge, nicht durch Druck. Wer genau beschreibt, was er braucht, Beispiele mitgibt und Rückmeldung sachlich formuliert, bekommt bessere Antworten. Das ist keine Frage der Höflichkeit gegenüber der Maschine, sondern der Arbeitsqualität. Und es passt zu dem Ton, den Sie sich auch unter Kolleginnen und Kollegen wünschen.

Häufige Fragen

Wird mein Konto gesperrt, wenn ich Claude anschnauze?

Nein. Anthropic schreibt, dass die Regel nur für Extremfälle gilt und alltäglichen Ärger, Widerspruch, düstere kreative Themen sowie Tests und Forschung nicht umfasst. Das wichtigste Mittel bleibt, dass Claude ein solches Gespräch beendet. Die Nutzungsrichtlinie nennt bei Verstößen allgemein Verwarnung, Drosselung, Einschränkung, Sperrung oder Kündigung des Zugangs.

Was passiert, wenn Claude ein Gespräch beendet?

In diesem Gespräch lassen sich keine weiteren Nachrichten schicken. Ein neues Gespräch können Sie sofort beginnen, andere Gespräche bleiben unberührt, und frühere Nachrichten lassen sich bearbeiten und neu abschicken.

Glaubt Anthropic, dass Claude Gefühle hat?

Das sagt Anthropic nicht. Das Unternehmen schreibt, es sei sehr unsicher, ob Claude oder andere Sprachmodelle einen moralischen Status haben. Es nehme die Frage aber ernst und suche nach Maßnahmen mit wenig Aufwand, falls das Wohlergehen von Modellen eine Rolle spielen sollte.

Gilt das auch für ChatGPT, Gemini oder Copilot?

Die neue Regel steht in der Nutzungsrichtlinie von Anthropic und gilt für dessen Modelle. Die anderen Anbieter haben eigene Bedingungen.

Quellen

  • Anthropic: 2026 Usage Policy update, 08.10.2026: anthropic.com
  • Anthropic: Usage Policy, gültig ab 12.11.2026: anthropic.com
  • Anthropic: Claude Opus 4 and 4.1 can now end a rare subset of conversations, 15.08.2025: anthropic.com

Ihre Meinung

Sie sehen das anders, haben eine Ergänzung oder eine Frage zum Beitrag? Schreiben Sie uns, wir antworten persönlich und nehmen gute Hinweise in den Beitrag auf.