SGLang은 Ling-3.0-flash 모델에 대한 당일 지원을 약속했으며, Ant 팀과 협력 중입니다. vLLM은 모델 가중치가 공개되는 대로 지원할 예정이며, 다른 벤더에게도 동일한 공개 패턴을 따르기를 권장하고 있습니다. llama.cpp는 Bailing MoE 변형을 지원하지 않아 gguf 측면에서 어려움이 있으며, 관련 기능 요청은 계획되지 않은 것으로 처리되었습니다.
모델 가중치가 공개되면 SGLang이 먼저 지원되고, 그 뒤로 vLLM이 지원될 예정이며, gguf는 자원봉사자가 나타나야 지원될 수 있습니다. K3 모델은 가중치가 공개된 지 몇 시간 만에 HF에 부분적인 gguf가 생성된 반면, Ling-3.0-flash는 해당 파이프라인이 아직 구축되지 않았습니다. Bailing MoE 변환 경로가 필요합니다.
Ant Ling AGI는 8월 3일까지 무료 액세스를 제공하며, 곧 오픈 소스 릴리스가 있을 예정이라고 발표했습니다. 이는 2.6-flash 모델과 유사한 패턴으로, 무료 기간 이후 가중치가 HF에 공개되었습니다. 모델 가중치 공개는 무료 액세스 기간을 따르는 패턴입니다.