Pulse · AI 뉴스

Ling-3.0-flash 모델, SGLang은 당일 지원, vLLM은 오픈 소스 시점 지원…llama.cpp는 미지원

Ling-3.0-flash · 2026-07-28

SGLang은 Ling-3.0-flash 모델에 대한 당일 지원을 약속했으며, Ant 팀과 협력 중입니다. vLLM은 모델 가중치가 공개되는 대로 지원할 예정이며, 다른 벤더에게도 동일한 공개 패턴을 따르기를 권장하고 있습니다. llama.cpp는 Bailing MoE 변형을 지원하지 않아 gguf 측면에서 어려움이 있으며, 관련 기능 요청은 계획되지 않은 것으로 처리되었습니다.

모델 가중치가 공개되면 SGLang이 먼저 지원되고, 그 뒤로 vLLM이 지원될 예정이며, gguf는 자원봉사자가 나타나야 지원될 수 있습니다. K3 모델은 가중치가 공개된 지 몇 시간 만에 HF에 부분적인 gguf가 생성된 반면, Ling-3.0-flash는 해당 파이프라인이 아직 구축되지 않았습니다. Bailing MoE 변환 경로가 필요합니다.

Ant Ling AGI는 8월 3일까지 무료 액세스를 제공하며, 곧 오픈 소스 릴리스가 있을 예정이라고 발표했습니다. 이는 2.6-flash 모델과 유사한 패턴으로, 무료 기간 이후 가중치가 HF에 공개되었습니다. 모델 가중치 공개는 무료 액세스 기간을 따르는 패턴입니다.

##모델출시##LLM##llama.cpp
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기