사용자 Kahvana가 Gemma4-26B-A4B-IT-QAT 모델에서 MTP 설정을 조정해 상당한 성능 향상을 발견했어요. n-max 3, min-p 0.2 설정이 자연어 처리 작업에서 132 t/s TG 성능을 보여줬으며, 31B 모델은 n-max 4, min-p 0.1을 선호했어요. 프로그래밍 작업에서는 Gemma 모델과 Qwen3.6-27B-MTP 모두 n-max 11, min-p 0.0 설정이 효과적이었어요.