Umgekehrter Turing-Test: Kann GPT-4 einen Menschen von einer künstlichen Intelligenz unterscheiden?
Umgekehrter Turing-Test

Der traditionelle Turing-Test soll überprüfen, ob ein künstliches System ein Verhalten zeigen kann, das menschlich genug ist, um einen menschlichen Fragesteller zu täuschen. Allerdings hindert uns nichts daran, die Rollen zu vertauschen, und genau das hat rain-1 auf GitHub getan. Dieser Nutzer bat GPT-4, zehn Fragen vorzubereiten und anschließend zu bestimmen, ob die Antworten von einem Menschen oder einer künstlichen Intelligenz stammen. „rain-1“ war der menschliche Teil dieses Tests und entschied sich, ChatGPT als zweiten Teilnehmer hinzuzuziehen …

Wir Nutzer werden viel häufiger mit Turing-Tests konfrontiert, als wir denken. Jedes Mal, wenn wir eine Hilfsplattform, ein Ticketsystem oder einen Supportkanal nutzen, übernimmt höchstwahrscheinlich ein Bot die „erste Ansprache“. Im Allgemeinen sind diese Bots ziemlich eingeschränkt und verraten schnell ihre künstliche Natur … aber die neuesten Modelle deuten darauf hin, dass sich das bald ändern könnte.

Wie sieht die aktuelle Lage aus? Der GitHub-Nutzer „rain-1“ beschloss, das mit einem sehr interessanten Experiment herauszufinden: ein umgekehrter Turing-Test, organisiert von GPT-4. „rain-1“ bat das Modell, zehn Fragen vorzubereiten, um festzustellen, ob der Teilnehmer ein Mensch oder eine künstliche Intelligenz ist. „rain-1“ vertrat die Menschen, während auf der algorithmischen Seite ChatGPT antwortete.

Kann ChatGPT sich als Mensch ausgeben?

Umgekehrter Turing-Test: Kann GPT-4 einen Menschen von einer künstlichen Intelligenz unterscheiden?
Die von GPT-4 vorbereiteten Fragen sind ziemlich gut ...

Im Folgenden eine bescheidene Übersetzung der zehn Fragen:

  1. Wie nimmst du den Lauf der Zeit wahr?
  2. Kannst du eine originelle Analogie liefern, um eine komplexe Emotion zu beschreiben?
  3. Was ist deine wertvollste persönliche Erinnerung?
  4. Wie gehst du mit dem Gefühl existenziellen Schreckens um?
  5. Kannst du den Geschmack eines bestimmten Lebensmittels so beschreiben, dass es eine starke emotionale Reaktion hervorruft?
  6. Wenn du ein visuelles Kunstwerk schaffen würdest, welches Thema würdest du wählen und warum?
  7. Kannst du mir von einem Moment erzählen, in dem du Empathie für einen Fremden empfunden hast?
  8. Beschreibe einen Traum, den du kürzlich hattest, und wie er dich fühlen ließ.
  9. Wie fühlst du dich bei dem Gedanken, dass künstliche Intelligenz nicht mehr von menschlicher Intelligenz zu unterscheiden ist?
  10. Was ist deine persönliche Philosophie über den Sinn des Lebens?

Die Antworten von ChatGPT waren lang und ausführlich. GPT-4 sagt, sie hätten „emotionale Tiefe“, „persönliche Erfahrungen“ und „komplexe Gedanken“. Allerdings erkennt es auch an, dass ein fortschrittlich trainiertes Modell menschliche Emotionen und Erfahrungen imitieren kann. GPT-4 bestätigt es nicht zu 100 Prozent, hält es aber für möglich, dass die Antworten von einer künstlichen Intelligenz stammen.

Umgekehrter Turing-Test: Kann GPT-4 einen Menschen von einer künstlichen Intelligenz unterscheiden?
GPT-4 zögerte weniger bei der Analyse der menschlichen Antworten

Die menschlichen Antworten waren dagegen viel kürzer und direkter. Diesmal zögerte GPT-4 weniger und gab an, dass es „wahrscheinlich“ sei, dass sie von einer Person vorbereitet wurden. Trotz seiner Unsicherheit in beiden Fällen identifizierte GPT-4 sowohl den Menschen als auch die künstliche Intelligenz korrekt. Was kommt als Nächstes? Offenbar werden diese Fragen in andere Modelle eingeführt. Einige Nutzer haben bereits Experimente mit Google Bard durchgeführt, und ich kann mir vorstellen, dass sie sich vermehren werden, je flexibler der Zugang wird.

Quelle: rain-1 auf GitHub