사용자가 Krea2 모델에 LoKr 기법을 적용해 캐릭터 LoRA와 유사한 결과를 얻었어요. 43장의 이미지 데이터셋으로 6 epoch 학습하며, 2천 스텝 정도에서 괜찮은 결과가 나왔어요. RTX 4070 Super 환경에서 텍스트 인코더와 트랜스포머를 일부 offload 해야 했어요.
LoKr은 기존 LoRA와 유사한 성능을 보이며, 큰 혁신적인 개선은 없었지만 준수한 결과 도출했어요. 50단어 프롬프트로 이미지의 구도, 머리카락, 표정, 의상, 포즈, 배경 등을 묘사하는 데 집중했어요. Qwen3 VL 4B instruct 모델로 캡션을 생성했어요.
학습 과정에서 10 rep x 43 image x 6 epoch으로 진행했으며, 430 스텝마다 저장했어요. 해상도는 512x768 픽셀이며, 학습률은 0.0001로 설정했어요.