Pulse · AI 뉴스

GPT-5.6 솔 에이전트, Kimi 모델 성능 406 tok/s로 최적화

Kimi · 2026-07-25

GPT-5.6 솔 에이전트들이 40시간 이상 협업하여 Kimi K3 유사 모델의 성능을 65 tok/s에서 406 tok/s로 최적화했어요.

WebGPU 커널을 활용하여 Kimi Delta Attention, Multi-Head Latent Attention, Mixture of Experts 성능을 향상시키는 데 큰 성과를 거뒀어요.

최적화 프레임워크의 전체 공개를 기대해 주세요.

##에이전트##최적화##Kimi
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기