SLAI T-Rex는 DeepSeek-V4 모델 패밀리를 Ascend NPU SuperPOD에서 후훈련하는 시스템입니다.
모델 병렬 처리, 연산-통신 조율, 저수준 커널 실행 최적화를 통해 34.22%의 모델 FLOPs 활용률(MFU)을 달성하며 기존 대비 2.93배 성능 향상했습니다.
DeepSeek-V4-Flash 모델을 활용해 OR(Operations Research) 관련 CPT(Continued Pre-training) 및 SFT(Supervised Fine-tuning) 데이터 파이프라인을 구축했습니다.
전문 모델은 GPT-5.4-Mini 및 DeepSeek-V4-Flash 기본 모델 대비 Pass@1 점수에서 각각 3.98% 및 11.27% 높은 71.81%를 기록했습니다.