Pulse · AI 뉴스

DeepSWE 벤치마크: Kimi K3 vs Claude Fable 5, 비용 대비 코딩 성능 비교

Kimi · 2026-07-24

Kimi K3와 Claude Fable 5를 활용해 DeepSWE 롤아웃 452회를 진행했어요. Claude Fable 5는 pass@1에서 1.4점 앞섰지만, Kimi K3는 pass@4에서 승리했어요.

Kimi K3는 달러당 2.8배 더 많은 문제를 해결하는 효율성을 보여줬어요. 비용 대비 성능을 중요시하는 경우 Kimi K3가 더 나은 선택이 될 수 있어요.

##DeepSWE##Kimi##Claude##코딩##벤치마크
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기