엔지넷타운 사용자가 Qwen3.6-27B 모델을 정밀도 손실 없이 압축하는 테스트 도구를 개발했어요. 기존 방식과 달리, 각 가중치 그룹별로 KL divergence를 측정하여 압축 가능 여부를 판단하는 방식이에요.
모델 크기에 따라 Bedrock(13.26GB), Tightrope(12.53GB), Gambit(10.94GB) 세 가지 버전이 제공되며, Gambit 버전은 VRAM 사용량을 최소화하면서도 성능을 유지해요.
도구 사용 후, 툴 콜링 성능이 가장 먼저 저하되는 경향을 보였으며, 사용자 피드백을 통해 개선해나갈 예정이에요. Hugging Face에서 모델을 다운로드할 수 있어요.