연구진이 VLM 데이터 구성 문제를 체계적인 혼합 최적화 문제로 정의하고, DecoupleMix 프레임워크를 통해 데이터 수집 가이드 및 데이터 검증 실험을 가능하게 했어요.
능력 간 비율을 단일 변수 반복 검색으로, 범주 내 비율을 품질과 난이도 평가를 기반으로 하는 볼록 최적화로 분리하는 방식을 사용했어요.
작은 규모의 프록시에서 발견된 최적 비율이 재조정 없이 더 큰 규모로 원활하게 이전되며, 800억 개의 멀티모달 토큰을 사용하여 강력한 오픈 소스 모델과 경쟁력을 보여줬어요.