사용자가 특정 언어 데이터가 아닌 '보편 언어' 기반으로 LLM을 학습시키는 방안을 제안했어요. 이렇게 학습하면 모델이 더 많은 정보를 저장하고 노이즈를 줄이며, 존재하지 않는 단어·참조 등 풍부한 요소를 포함할 수 있다고 주장합니다. 보편 언어로 학습된 LLM은 특정 언어로 번역하는 소형 모델과 결합하여 활용될 수 있다고 설명합니다. 기술 전문가들의 의견을 구하며, 이미 유사한 연구나 모델이 있는지 궁금해합니다.