IvGranite 사용자가 35B 코더 모델 에이전트 비교 테스트를 진행했어요. KAT-Coder-V2.5-Dev 모델이 기존 모델 대비 효율성과 정확성 면에서 우수한 성능을 보였어요.
KAT-Coder-V2.5-Dev는 6개의 자체 평가 작업에서 29/30의 높은 합격률을 기록하며, 입력 토큰 사용량은 절반으로 줄였어요. 또한 도구 사용 과정에서 오류가 거의 발생하지 않았어요.
전체 분석 결과와 방법론은 kmarble.dev에서 확인할 수 있으며, AI 분석가와 사용자가 함께 검토한 결과예요.