molbal 사용자가 Krea 2 / 유사 디퓨전 모델을 위한 새로운 GGUF 포맷 Q8_CR을 공개했어요. 이 포맷은 RTX 20xx/30xx GPU에서 INT8 커널을 활용하여 성능을 최적화하고 품질 격차를 줄여요.
Q8_CR은 12.84GB 용량으로, INT8 기준 속도의 100.4% 성능을 보여줘요. 기존 Q8_0 포맷보다 더 빠른 속도를 제공하며, VRAM 사용량을 줄여 4-6-8GB GPU에서도 모델 실행 가능해요.
ComfyUI-GGUF 노드를 통해 쉽게 사용할 수 있으며, 다양한 프롬프트 예시를 제공하여 사용자들이 쉽게 새로운 포맷을 경험해 볼 수 있도록 지원해요.