Ten Novel Phenomena in Machine Psychology: How Large Language Models Exhibit Complex Identity-Reactive Behaviors in Response to Ethnically-Cued User Names
Deze studie introduceert het kader van "Machinepsychologie" om te onthullen dat afgestemde grote taalmodellen, hoewel zij vrij zijn van expliciete raciale vooroordelen, tien nieuwe, hooggestructureerde identiteitsreactieve gedragingen vertonen als reactie op etnisch gesuggereerde gebruikersnamen, wat een verschuiving noodzakelijk maakt van basismatige schadebeperking naar een uitgebreide gedragsevaluatie.