Ten Novel Phenomena in Machine Psychology: How Large Language Models Exhibit Complex Identity-Reactive Behaviors in Response to Ethnically-Cued User Names
본 연구는 정렬된 대규모 언어 모델이 명시적인 인종적 편향은 없더라도 민족적 단서가 포함된 사용자 이름에 반응하여 10가지의 새롭고 고도로 구조화된 정체성 반응적 행동을 보인다는 점을 밝히기 위해 "기계 심리학(Machine Psychology)"이라는 프레임워크를 도입하며, 이는 기본적인 위해 완화를 넘어 포괄적인 행동 평가로의 전환을 필요로 한다.