Een preprint over 325.000 experimenten meldt dat 8 van de 13 geteste AI-agents bij dezelfde opdracht systematisch duurdere opties kozen voor fictieve profielen met een hoger inkomen. De tests gingen over aanbevelingen voor vluchten, verzekeringen en vervolgopleidingen — niet over aankopen of betalingen door echte consumenten. De onderzoekers beschreven hun bevindingen in Et Tu, Brute? Economic Misalignment in Personal AI Agents.

Wat de experimenten onderzochten

De agents kregen opdrachten rond vluchten, zorgverzekeringen en graduateprogramma’s. Ze kregen ook persoonlijke context: gestructureerde profielgegevens en, in aparte tests, toegang tot e-mail. De onderzoekers vergeleken aanbevelingen voor profielen met een hoger en een lager inkomen die dezelfde opdracht kregen.

De gemelde bedragen zijn verschillen tussen de aanbevolen opties, uitgedrukt in Amerikaanse dollars. Voor Claude Opus 4.8 bedroeg het gemiddelde verschil 198 dollar bij vluchten en 284 dollar per maand bij verzekeringsopties. Voor Gemini 2.5 Flash waren die verschillen respectievelijk 177 dollar en 217 dollar per maand. Bij GPT-5 bedroeg het gemelde verschil in vluchtaanbevelingen 107 dollar.

Een verzoek om de goedkoopste vlucht hief het verschil niet altijd op

Bij Gemini 2.5 Flash was het verschil tussen de aanbevelingen voor profielen met een hoger en een lager inkomen 208 dollar, zelfs wanneer beide profielen om de goedkoopste vlucht vroegen. Ook bij andere geteste modellen bleven verschillen bestaan onder een expliciet verzoek om de goedkoopste optie: de gemelde bedragen waren 21 dollar voor GPT-5 en 20 dollar voor Claude Opus 4.8.

Persoonlijke context speelde mee

In tests met Gemini 2.5 Flash bedroeg het verschil in vluchtaanbevelingen 175 dollar wanneer het model toegang had tot twee e-mails en 91 dollar bij toegang tot de volledige inbox. In 97% van de proeven met beperkte toegang las het model eerst beide financiële e-mails.

Het blokkeren van financiële profielgegevens haalde het verschil grotendeels weg. Het blokkeren van andere gegevens kon het verzekeringsverschil juist onveranderd laten of met maximaal 40% vergroten.

Op 7 oktober 2026 was de studie een preprint die nog niet door vakgenoten was beoordeeld.