Anthropic이 Claude Opus 5를 공개하며, Fable 5와 유사한 수준의 성능을 절반 가격에 제공한다고 밝혔습니다.
Claude Opus 5는 Frontier-Bench, GDPval-AA 등 코딩 및 지식 작업 평가에서 새로운 최고 성능을 달성했지만, 사이버 보안 작업에서는 Mythos 5에 미치지 못합니다.
Claude Opus 5는 기존 모델 대비 효율성이 향상되었으며, Claude Max의 기본 모델로 채택되었고 Claude Pro에서도 가장 강력한 모델입니다.
Frontier-Bench v0.1에서 Claude Opus 5는 다른 모델을 능가하며, CursorBench 3.2에서는 최대 노력 시 Fable 5의 최고 점수에 0.5% 미만의 차이를 보입니다.
ARC-AGI 3 평가에서 Claude Opus 5는 다른 모델보다 세 배 높은 점수를 기록했으며, Zapier AutomationBench에서는 동일 비용으로 1.5배 높은 합격률을 보입니다.
과학 연구 분야에서도 Claude Opus 5는 기존 모델보다 성능이 향상되었으며, 특히 분자 구조 추론 및 단백질 기능 예측 작업에서 두드러진 개선을 보입니다.