흥미로운 AI 심리학 연구: 거대 언어 모델에도 '초두 효과'가 있을까요?
Mika Hämäläinen의 연구는 Asch의 유명한 초두 효과 실험을 ChatGPT, Gemini, Claude 세 가지 LLM에 적용하여 각 모델의 반응을 비교 분석했습니다. 결과적으로 모델마다 초두 효과에 대한 반응이 다르게 나타나, LLM의 심리학적 특성과 한계를 보여주는 흥미로운 연구입니다.

거대 언어 모델의 심리? '초두 효과' 실험 결과 발표!
최근 Mika Hämäläinen의 연구는 AI 분야에 새로운 시각을 제시했습니다. 바로 인간 심리학의 고전적 개념인 '초두 효과'를 거대 언어 모델(LLM)에 적용한 연구입니다. Asch의 유명한 실험을 재구성하여 ChatGPT, Gemini, Claude 세 모델을 대상으로 실험을 진행했습니다.
Asch 실험, AI에게 적용하다
Asch의 실험은 간단합니다. 긍정적 형용사를 먼저 제시한 후 부정적 형용사를 제시하는 후보와, 그 반대의 경우 두 후보를 제시하고 어떤 후보를 선호하는지 확인하는 실험입니다. Hämäläinen은 이 실험을 두 가지 방식으로 진행했습니다. 첫 번째는 두 후보를 동시에 제시하고, 두 번째는 각 후보를 따로 제시하는 방식입니다. 각 모델에 200개의 후보 쌍을 테스트했습니다.
놀라운 결과: 모델별 상반된 반응
결과는 매우 흥미로웠습니다. 첫 번째 실험에서 ChatGPT는 긍정적 형용사가 먼저 제시된 후보를 선호한 반면, Gemini는 두 후보를 동일하게 선호했습니다. Claude는 아예 선택을 거부했습니다. 두 번째 실험에서는 ChatGPT와 Claude가 두 후보를 동등하게 평가하는 경향을 보였습니다. 동등하게 평가하지 않은 경우에는 부정적 형용사가 먼저 제시된 후보를 선호하는 경향이 나타났습니다. Gemini는 부정적 형용사가 먼저 제시된 후보를 선호하는 경향이 가장 강했습니다.
의미와 시사점: LLM의 '심리' 탐구
이 연구는 LLM이 단순한 정보 처리 시스템이 아닌, '심리학적' 특성을 지닐 수 있다는 점을 시사합니다. 모델마다 초두 효과에 대한 반응이 다르게 나타난 것은 각 모델의 학습 데이터, 알고리즘, 그리고 아키텍처의 차이를 반영하는 것으로 해석될 수 있습니다. 이는 LLM 개발에 있어서 단순한 성능 향상뿐 아니라, 모델의 '심리적' 특성을 이해하고 제어하는 것이 중요하다는 것을 의미합니다. 앞으로 더 많은 연구를 통해 LLM의 '마음'을 들여다볼 수 있기를 기대합니다. 하지만, 현재로서는 각 모델의 결과가 일관적이지 않다는 점을 유의해야 합니다. 더 많은 연구와 데이터가 필요한 분야임을 명심해야 합니다.
참고: 본 기사는 Mika Hämäläinen의 연구 논문을 바탕으로 작성되었습니다. 논문의 자세한 내용은 원문을 참고하시기 바랍니다.
Reference
[arxiv] On Psychology of AI -- Does Primacy Effect Affect ChatGPT and Other LLMs?
Published: (Updated: )
Author: Mika Hämäläinen
http://arxiv.org/abs/2504.20444v1