Pulse · AI 뉴스

아첨을 넘어: LLM 도덕적 판단의 구조화된 저항과 순응

arXiv cs.AI · 2026-07-24

연구팀은 LLM이 타인의 의견에 맹목적으로 따르지 않고, 자신의 도덕적 판단을 유지하는 능력을 연구했어요. 세 가지 연구를 통해 모델의 판단 수정 과정이 인간 사회심리학의 현상과 유사한 세 가지 차원(입장의 거리, 출처, 지지 연합 구조)을 따른다는 것을 밝혀냈어요. 모델은 일반적으로 자신의 입장과 가까운 의견에 더 수용적이며, 자신의 이전 판단으로 제시된 의견에 더 영향을 받고, 집단 압력에 다르게 반응하는 경향이 있어요.

##LLM##도덕적판단##사회심리학##인공지능##모델정렬
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기