유저 TrevTron이 Youyeetoo X1S SBC(Celeron N5095)에서 Ollama를 CPU 모드로 실행하여 저가형 LLM 추론 가능성을 테스트했어요.
0.6B 모델인 Qwen3는 평균 6.788 tok/s를 기록하며 인터랙티브 사용이 가능했지만, 8B 모델은 평균 0.924 tok/s로 실용성이 떨어졌어요.
15분간 코어 전체 스트레스 테스트 결과, 평균 74.66℃, 최대 77℃까지 상승했지만, 기본 쿨링 솔루션으로도 스로틀링은 발생하지 않았어요.
Jasper Lake iGPU에서 Vulkan 추론 성능을 테스트할 예정이며, 결과는 추후 공유할 예정이에요.