SLAI 팀이 DeepSeek-V4 모델 패밀리를 Ascend NPU SuperPOD 환경에서 최적화하는 연구를 발표했어요. 모델 병렬 처리, 통신 관리, 커널 실행을 개선하여 기존 레시피 대비 2.93배 향상된 성능을 달성했어요.
최적화된 인프라를 기반으로 복잡한 Operations Research(OR) 작업을 위한 CPT 및 SFT 워크플로우를 구축하여 10,000개의 고품질 SFT 샘플을 생성했어요.
개발된 DeepSeek-V4-Flash 모델은 GPT-5.4-Mini 및 기본 DeepSeek-V4-Flash 모델보다 높은 Pass@1 점수를 기록하며 OR 문제 해결 능력을 입증했어요.