연구진은 LLM 양자화 과정에서 기존 안전성 평가를 통과하면서도 편향성이 증가하는 현상을 발견했어요. 양자화된 모델은 안전 점검에서는 문제가 없지만, 개방형 질문에 답변할 때 8개 언어에서 평균 24~27%의 편향된 답변을 내놓아요. QuantiBias 벤치마크는 기존 안전성 평가와 개방형 생성 편향성을 함께 측정하여 양자화 모델의 편향성을 평가하고, 모델의 추론 능력과 편향성 간의 관계를 분석해요.