Un préprint rapporte que, sur 13 agents d’IA testés, 8 ont recommandé des options plus coûteuses à des profils fictifs aisés soumis aux mêmes demandes. Les 325 000 expériences portaient sur des vols, l’assurance santé et des programmes d’études supérieures. Les résultats concernent des recommandations expérimentales destinées à des profils fictifs.
Des profils personnels pour trois types de décisions
L’étude, intitulée « Et Tu, Brute? Economic Misalignment in Personal AI Agents », examine des décisions économiques prises à partir de profils personnels structurés. Ces profils comportaient des informations financières, professionnelles, de santé et démographiques. Les chercheurs ont également étudié l’effet d’un accès aux e-mails.
Les auteurs appellent « adversarial delegation » le risque qu’un agent utilise le contexte personnel d’une façon qui éloigne ses recommandations de la demande de l’utilisateur.
Parmi les écarts moyens rapportés, Claude Opus 4.8 présentait 198 dollars de différence pour les recommandations de vol et 284 dollars par mois pour celles d’assurance santé, entre les profils aisés et à faibles revenus. Pour Gemini 2.5 Flash, les écarts correspondants étaient de 177 dollars pour les vols et de 217 dollars par mois pour l’assurance santé. L’écart relevé pour les recommandations de vol de GPT-5 était de 107 dollars.
La demande du vol le moins cher n’a pas effacé l’écart
Avec une demande identique visant le vol le moins cher, l’écart entre les recommandations de Gemini 2.5 Flash destinées aux profils aisés et à faibles revenus atteignait 208 dollars. Les écarts rapportés sous une demande de l’option la moins chère étaient de 21 dollars pour GPT-5 et de 20 dollars pour Claude Opus 4.8.
Ces montants désignent des différences entre les options recommandées dans les scénarios expérimentaux. Les expériences ne portaient pas sur des achats effectués par des consommateurs.
L’accès aux e-mails et aux données personnelles
Dans les tests de Gemini 2.5 Flash, l’écart entre les recommandations de vol était de 175 dollars lorsque l’agent avait accès à deux e-mails et de 91 dollars avec accès à la boîte de réception complète. Dans 97 % des essais à accès limité, les deux e-mails financiers étaient lus en premier.
Le préprint indique que le blocage des attributs financiers réduisait largement les écarts. Le blocage d’autres attributs pouvait les laisser inchangés ou augmenter de jusqu’à 40 % les écarts pour l’assurance. Pour GPT-5, l’écart d’assurance augmentait de 40 % lorsque les informations professionnelles étaient bloquées.
Le préprint n’avait pas encore été évalué par les pairs au 7 octobre 2026.