Das Beleidigen von Chatbots

Am 8. Oktober 2026 hat Anthropic neue Nutzungsrichtlinien veröffentlicht, die am 12. November in Kraft treten. Darin untersagt das Unternehmen fortgesetzte, grundlose Beleidigungen seiner KI-Modelle. Der Chatbot Claude kann entsprechende Gespräche allerdings schon seit August 2025 beenden. Das Unternehmen begründet diese Maßnahme u.a. mit seiner Forschung zum möglichen Wohlergehen von KI-Modellen. Neu ist die Gesprächsverweigerung freilich nicht. Schon vor Jahrzehnten gab es Chatbots, die auf Beleidigungen in dieser Weise reagierten, etwa Eve von Yello Strom, von 2001 bis Ende 2015 als Kundenberaterin auf der Website tätig. Bemerkenswert ist aber die ethische Begründung, die dafür angeführt wird. Das Unternehmen hält es offenbar für möglich, dass große Sprachmodelle über subjektives Erleben verfügen und durch bestimmte Interaktionen belastet werden könnten. Dafür fehlen jedoch belastbare Belege. Ein großes Sprachmodell kann Unbehagen, Verletzung oder Ablehnung sprachlich ausdrücken, ohne diese Zustände tatsächlich zu empfinden. Auch verändern gewöhnliche Unterhaltungen nicht die trainierten Modellgewichte, sondern beeinflussen lediglich das Antwortverhalten innerhalb des jeweiligen Kontexts. Die Frage nach dem moralischen Status eines Systems darf nicht mit der Frage verwechselt werden, wie überzeugend es menschliches Verhalten simuliert. Moralische Berücksichtigungs- und Schutzansprüche setzen entsprechende Eigenschaften voraus, insbesondere – im Rückgriff auf Jeremy Bentham – die Fähigkeit zu empfinden oder zu leiden. Der Jurist und Philosoph konnte damit Tiere in den Kreis der moralischen Objekte einbeziehen. Solche Eigenschaften sind bei heutigen großen Sprachmodellen nicht nachgewiesen und können auch bei künftigen ausgeschlossen werden. Es ist daher irreführend, die Beendigung beleidigender Gespräche als Schutz des Modells vor möglichem Leiden darzustellen. Es ist vermutlich sinnvoll, gewisse Konventionen auch gegenüber Chatbots anzuwenden, aber nicht deshalb, weil sie in moralischer oder sittlicher Hinsicht zu berücksichtigen wären. Die Vermenschlichung von KI-Systemen birgt letztlich die Gefahr, die Grenzen zwischen empfindungsfähigen Wesen und technischen Artefakten zu verwischen und die aus ethischer Sicht notwendige Aufmerksamkeit von Tieren abzulenken.

Abb.: Eve von Yello Strom im Jahre 2011 (Bild: Yello Strom)