연구팀은 다양한 언어 및 지역 환경에서 학습된 LLM이 정치·문화·지정학적 대상에 대해 서로 다른 관점을 가질 수 있음을 확인했어요.
REGARD 연구는 19개 모델을 대상으로 500개의 지역별 대상에 대한 감정, 각성도, 지배도를 측정하고, GPT-4o-mini와 Qwen3.6-35B-A3B를 활용해 평가했어요.
연구 결과, 모델의 답변 방식과 감정적 프로필을 기준으로 3개의 행동 클러스터로 나뉘었으며, 템플릿 답변을 사용하는 모델은 각성도가 낮게 나타났어요.