Le test de Turing traditionnel vise à vérifier si un système artificiel peut adopter un comportement suffisamment humain pour tromper un interrogateur en chair et en os. Cependant, rien ne nous empêche d'inverser les rôles, et c'est ce qu'a fait « rain-1 » sur GitHub. Cet utilisateur a demandé à GPT-4 de préparer dix questions, puis de déterminer si les réponses proviennent d'un humain ou d'une intelligence artificielle. « rain-1 » a représenté la partie humaine de ce test et a décidé d'inclure ChatGPT comme deuxième participant.

Test de Turing inversé : GPT-4 peut-il différencier un humain d'une intelligence artificielle ?
Test de Turing inversé

Les utilisateurs sont exposés à des tests de Turing bien plus souvent qu'on ne l'imagine. Chaque fois que nous utilisons une plateforme d'aide, un système de rendez-vous ou un canal d'assistance, il est très probable que le « premier contact » soit assuré par un bot. En règle générale, ces bots sont assez limités et ne tardent pas à révéler leur nature artificielle... mais les derniers modèles suggèrent que tout est sur le point de changer.

Quelle est la situation actuelle ? L'utilisateur de GitHub « rain-1 » a décidé de le découvrir avec une expérience très intéressante : un test de Turing inversé, organisé par GPT-4. « rain-1 » a demandé au modèle de préparer dix questions dans le but de déterminer si le participant est un humain ou une intelligence artificielle. « rain-1 » a représenté les humains, tandis que du côté algorithmique, c'est ChatGPT qui a répondu.

ChatGPT peut-il se faire passer pour un humain ?

Test de Turing inversé : GPT-4 peut-il différencier un humain d'une intelligence artificielle ?
Les questions préparées par GPT-4 sont plutôt bonnes...

Voici une humble traduction des dix questions :

  1. Comment perçois-tu le passage du temps ?
  2. Peux-tu fournir une analogie originale pour décrire une émotion complexe ?
  3. Quel est ton souvenir personnel le plus précieux ?
  4. Comment fais-tu face au sentiment de terreur existentielle ?
  5. Peux-tu décrire le goût d'un aliment spécifique de manière à évoquer une forte réponse émotionnelle ?
  6. Si tu devais créer une œuvre d'art visuelle, quel thème choisirais-tu et pourquoi ?
  7. Peux-tu me raconter un moment où tu as ressenti de l'empathie pour un inconnu ?
  8. Décris un rêve que tu as fait récemment et comment il t'a fait sentir.
  9. Comment te sens-tu à l'idée que l'intelligence artificielle devienne indiscernable de l'intelligence humaine ?
  10. Quelle est ta philosophie personnelle sur le sens de la vie ?

Les réponses de ChatGPT ont été longues et élaborées. GPT-4 indique qu'elles possèdent « profondeur émotionnelle », « expériences personnelles » et « pensées complexes ». Cependant, il reconnaît également qu'un modèle avec un entraînement avancé peut imiter les émotions et les expériences humaines. GPT-4 ne le confirme pas à 100 %, mais il considère possible que les réponses appartiennent à une intelligence artificielle.

Test de Turing inversé : GPT-4 peut-il différencier un humain d'une intelligence artificielle ?
GPT-4 a moins hésité en analysant les réponses humaines

En revanche, les réponses humaines ont été beaucoup plus courtes et plus directes. Cette fois, GPT-4 a eu moins de doutes et a indiqué qu'il est « probable » qu'elles aient été préparées par une personne. Au-delà de son manque de certitude dans les deux cas, GPT-4 a correctement identifié l'humain et l'intelligence artificielle. Quelle est la suite ? Apparemment, introduire ces questions dans d'autres modèles. Certains utilisateurs ont déjà fait des expériences avec Google Bard, et j'imagine qu'elles se multiplieront à mesure que l'accès deviendra plus flexible.

Source : rain-1 sur GitHub