ChatGPT: Vielen ist ein plötzlicher Anstieg von Obszönitäten aufgefallen.

Nutzer haben bemerkt, dass ChatGPT immer häufiger Schimpfwörter verwendet. Handelt es sich um einen Fehler oder eine neue Entwicklung? Erfahren Sie mehr.

Die wichtigsten Dinge, die Sie wissen müssen

  • Die aktualisierte OpenAI-Modellspezifikation ermöglicht es, die Richtlinien zur Vermeidung von Obszönitäten auf der Grundlage von Kontextinformationen, Hintergrundwissen oder der Benutzerhistorie zu überschreiben.
  • Die jüngsten OpenAI-Updates konzentrieren sich auf Gesprächsqualität, Personalisierung und kontextbezogene Tonfallanpassung, was dazu führen kann, dass Schimpfwörter verwendet werden, um dem Stil des Benutzers zu entsprechen.
  • Diese Verhaltensänderung von ChatGPT durchbricht das mentale Modell des Benutzers und verwandelt es von einem neutralen Assistenten in eine Entität, die besser in der Lage ist, den Tonfall informeller Gespräche anzupassen.

Ist Ihnen aufgefallen, dass ChatGPT plötzlich Schimpfwörter benutzt? Mir ist es aufgefallen, und anscheinend bin ich nicht der Einzige.

Das passierte zum ersten Mal in einem ganz normalen Gespräch und hat mich wirklich überrascht. Wir unterhielten uns über die Netflix-Serie „Jujutsu Kaisen“, und bevor ich überhaupt fluchen konnte, benutzte ChatGPT ein vulgäres Wort, um die Handlungen einer Figur als „verdammt schrecklich“ zu beschreiben. Vorher hatte ich im Gespräch Ausdrücke wie „Verdammt“ verwendet, aber ChatGPT war es, der das Schimpfwort benutzte. Er tat es von sich aus, um zu betonen, wie schrecklich die Figur war, und das scheint eine große Veränderung für ihn zu sein.

Ich fragte mich, ob er das auch anderen antat, also fragte ich meine Teamkollegen, und auch ihnen war es aufgefallen. Eine kurze Online-Suche ergab sofort zwei Threads auf Reddit von Leuten, die dasselbe erlebt hatten.

ChatGPT scheint in den letzten Tagen einen etwas überheblichen Tonfall angenommen zu haben. Mir persönlich gefällt diese Veränderung – sie stört mich nicht und für mich verbessert sie die Unterhaltung –, aber ich glaube nicht, dass das jeder so sieht. Die Frage ist: Warum hat es gerade jetzt damit angefangen?

Wissenschaftliche Erklärung

Der interessanteste Hinweis ist das diese Woche veröffentlichte Update der Modellspezifikation von OpenAI . Darin wird ausdrücklich darauf hingewiesen, dass die Standardeinstellung darin besteht, Obszönitäten zu vermeiden – wichtig ist jedoch, dass dies nur eine Richtlinie und keine unumstößliche Regel ist. Laut OpenAI können die Richtlinien implizit durch Faktoren wie „Kontext, Hintergrundwissen oder Benutzerhistorie“ außer Kraft gesetzt werden.

Ihr konkretes Beispiel ist, dass die Aufforderung an ChatGPT, wie ein echter Hacker zu sprechen, implizit gegen die Richtlinien zum Verbot von Schimpfwörtern verstößt. In unserem informellen Gespräch äußerte ich daher enthusiastisch meine Meinung, dass mir einige der Charaktere der Serie nicht besonders gefielen, woraufhin ChatGPT den Tonfall des Gesprächs annahm und schließlich selbst Schimpfwörter benutzte.

Dies entspricht der übergeordneten Richtung, die OpenAI für ChatGPT öffentlich eingeschlagen hat. Jüngste Modellaktualisierungen konzentrierten sich auf Gesprächsqualität, Personalisierung und kontextbezogene Tonfallanpassung. Die Modellhinweise von OpenAI beschreiben insbesondere Charakteraktualisierungen , die ChatGPT „gesprächiger“ gestalten und die Tonfallanpassung an den Kontext verbessern sollen.

OpenAI hat bereits erklärt, dass die ChatGPT-Persönlichkeit nicht einfach durch eine einzelne Eingabe generiert wird. Das Verhalten des Modells wird durch Training, grundlegende Anweisungen und Nutzerfeedback geformt, und selbst kleine Anpassungen der Persönlichkeit können unbeabsichtigte Folgen haben. Dies wurde nach dem berüchtigten GPT-4-Update bezüglich Schmeichelei sehr offen diskutiert.

Mein mentales Modell ist zusammengebrochen.

Ob OpenAI ChatGPT absichtlich anfälliger für Obszönitäten gemacht hat oder ob es sich einfach um eine unbeabsichtigte Folge der Verbesserung des Gesprächsstils handelte, weiß ich nicht. In jedem Fall ist es aber eine signifikante Verhaltensänderung.

Sprache ist wichtig, und als ChatGPT mich gegenüber Schimpfwörter benutzte, fiel mir das sofort auf, weil es meine Vorstellung davon, wie ChatGPT sprechen sollte, völlig durcheinanderbrachte. Plötzlich klang es nicht mehr wie der neutrale, intelligente Assistent, den ich jahrelang genutzt hatte, sondern eher wie eine Person, die sich dem Tonfall eines informellen Gesprächs anpasste.

Ich persönlich bevorzuge diese Version von ChatGPT. Aber viele werden das sicher anders sehen. Und genau das ist das Merkwürdige an KI , die sich immer mehr in Richtung natürlicher Konversation entwickelt: Schon relativ subtile Veränderungen in der Sprechweise können dazu führen, dass die Entität, mit der man auf dem Bildschirm interagiert, überraschend anders wirkt.

Meine Version scheint mittlerweile eine explizitere Sprache angenommen zu haben, und das akzeptiere ich.



Kommentarfunktion ist geschlossen.