AlperKTS가 Krea 2 Turbo 모델의 SVDQuant 버전 ComfyUI 체크포인트를 공개했어요. FP8 대비 최대 2배 빠른 속도와 약 3분의 1 크기를 제공하며, 별도 교정 데이터셋이나 품질 저하 없이 사용 가능해요.
RTX 20/30 시리즈 GPU에서 FP8는 bf16으로 캐스팅되어 속도가 느려지지만, INT8 및 W4A4는 Turing 이후 GPU에서 활용 가능하며, 최대 2.1배 빠른 속도를 낼 수 있어요.
LoRA 로더 버그 수정 및 성능 향상, 다양한 벤치마크 결과와 예시 이미지를 Hugging Face 저장소에서 확인할 수 있으며, 라이선스 정보는 GitHub 저장소에 명시돼 있어요.