Pulse · AI 뉴스

MoE 모델에서 MTP가 중요할 수 있습니다

Gemma · 2026-07-21

사용자 Kahvana가 Gemma4-26B-A4B-IT-QAT 모델에서 MTP 설정을 조정해 상당한 성능 향상을 발견했어요.

n-max 3, min-p 0.2 설정이 자연어 처리 작업에서 132 t/s TG 성능을 보여줬으며, 31B 모델은 n-max 4, min-p 0.1을 선호했어요.

프로그래밍 작업에서는 Gemma 모델과 Qwen3.6-27B-MTP 모두 n-max 11, min-p 0.0 설정이 효과적이었어요.

##MTP##MoE##Gemma##llama.cpp
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기