사용자가 80개의 RTX 5090 GPU를 연결한 시스템에서 Kimi K3 모델을 실행하는 데 성공했어요. 25GbE 이더넷을 통해 GPU 간 통신을 구현했어요. 이 방법은 대규모 모델을 저렴하게 실행할 수 있는 가능성을 보여줘요. Kimi K3는 70B 파라미터 모델로, 고성능 GPU 클러스터에서 실행해야 효율적이에요. 사용자는 이 방법을 통해 Kimi K3를 개인 환경에서 사용할 수 있게 되었어요.