사용자가 GLM 5.2 모델을 ik_llama.ccp 환경에서 테스트하던 중, 32~64k 이상의 장문 컨텍스트에서 생성 시 오류가 발생했어요. 오류는 llama-sampling.cpp에서 발생하며, 확률 파일에 NaN 값이 기록되는 현상이 나타났어요. GPU 사용 시 해결 방법을 찾기 어려워 CPU-only 사용을 고려 중이며, 관련 문제 해결 경험 공유를 요청했어요.