Pulse · AI 뉴스

Celeron N5095 SBC에서 CPU만으로 LLM 추론: 0.6B~8B 모델 벤치마크

Ollama · 2026-07-24

유저 TrevTron이 Youyeetoo X1S SBC(Celeron N5095)에서 Ollama를 CPU 모드로 실행하여 저가형 LLM 추론 가능성을 테스트했어요.

0.6B 모델인 Qwen3는 평균 6.788 tok/s를 기록하며 인터랙티브 사용이 가능했지만, 8B 모델은 평균 0.924 tok/s로 실용성이 떨어졌어요.

15분간 코어 전체 스트레스 테스트 결과, 평균 74.66℃, 최대 77℃까지 상승했지만, 기본 쿨링 솔루션으로도 스로틀링은 발생하지 않았어요.

Jasper Lake iGPU에서 Vulkan 추론 성능을 테스트할 예정이며, 결과는 추후 공유할 예정이에요.

##LLM##추론##Celeron##SBC##Ollama
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기