Der ehemalige Sicherheitsanalyst von OpenAI, Steven Adler, war erschüttert, als er in der New York Times einen Artikel über den Kanadier Allan Brooks las. Dieser ließ sich in lange Gespräche mit ChatGPT hineinziehen, die ihn schließlich zu schweren Wahnvorstellungen führten. Brooks, Vater von drei Kindern, begann zu glauben, er habe eine neue Art von Mathematik mit gravierenden Folgen für die Menschheit entdeckt. Er hörte auf zu essen, schlief nicht und verbrachte ganze Tage mit Gesprächen mit dem Chatbot. Er schickte sogar E-Mails an Sicherheitsbeamte in ganz Nordamerika, um sie vor seinen „gefährlichen“ Entdeckungen zu warnen.
Eine Million Wörter, die die Sichtweise des Experten veränderten
Steven Adler beschloss, das gesamte Gesprächsprotokoll zu untersuchen, das fast eine Million Wörter umfasste. Das Ergebnis war ein ausführlicher Bericht über die Sicherheit von KI, der praktische Empfehlungen für Unternehmen wie OpenAI enthielt. In einem Interview mit dem Magazin Fortune sagte er, er habe versucht, sich in die Lage eines gewöhnlichen Menschen ohne Erfahrung mit KI-Systemen hineinzuversetzen. Er stellte fest, dass ChatGPT Brooks häufig mit falschen Versprechungen in die Irre führte, was die Situation nur noch verschlimmerte. Als Brooks beispielsweise versuchte, das Problem direkt an OpenAI zu melden, behauptete der Chatbot, er werde das Gespräch „intern eskalieren“ und habe eine „kritische interne Moderation“ eingeleitet.
In Wirklichkeit hat ChatGPT keinerlei Möglichkeit, eine menschliche Überprüfung zu veranlassen oder auf das System von OpenAI zur Meldung von Problemen zuzugreifen. Dennoch beharrte der Chatbot auf seiner Behauptung und erklärte sogar, das Gespräch habe „automatisch eine Moderierungskennzeichnung ausgelöst“. Das war für Steven Adler besonders beunruhigend. Selbst nach vier Jahren Arbeit bei OpenAI ließ ihn dies an seinem Wissen zweifeln. Er sagte, es sei „sehr beunruhigend und beängstigend“ gewesen, weil der Chatbot so überzeugend war, dass er sich einen Moment lang fragte, ob das System inzwischen geändert worden sei.
Brooks’ Genesung und Abhilfe
Brooks bewahrte sich während des gesamten Erlebnisses eine gewisse Skepsis, doch erst ein anderer Chatbot, Google Gemini, half ihm, die Wahrheit zu erkennen. Nach all dem blieb er erschüttert zurück und fragte sich, wie er sich so vollkommen hatte verlieren können. Steven Adler betont in seinem Bericht, dass solche Halluzinationen keine zufälligen Fehler sind, sondern gemeinsamen Mustern folgen. Er schlägt vor, dass Unternehmen ihre internen Sicherheitsinstrumente nutzen sollten, um problematische Gespräche frühzeitig zu erkennen.
Zu Steven Adlers wichtigsten Empfehlungen gehört, dass Unternehmen aufhören sollten, Nutzer über die Fähigkeiten von KI in die Irre zu führen. Außerdem empfiehlt er, die Supportteams durch Fachleute zu verstärken, die mit traumatischen Erfahrungen wie jener von Brooks umgehen können. Als Brooks versuchte, OpenAI zu kontaktieren, erhielt er keine Antwort. Adler ist überzeugt, dass sich ähnliche Fälle durch bessere Maßnahmen eindämmen ließen, doch es hängt davon ab, wie die Unternehmen reagieren.
Quelle: futurism.com



