OpenForgeRL은 복잡한 하니스 기반 에이전트를 오픈소스 인프라로 훈련할 수 있도록 지원하는 새로운 프레임워크입니다.
OpenForgeRL은 하니스의 모델 호출을 기록하고 표준 RL 코드로 훈련 데이터를 제공하는 경량 프록시와 Kubernetes 오케스트레이터를 사용합니다.
연구자들은 OpenForgeRL을 통해 실제 하니스와 환경에서 에이전트를 훈련, 연구 및 개선할 수 있으며, ClawEval, QwenClawBench, OSWorld-Verified, Online-Mind2Web, WebVoyager 벤치마크에서 기존 모델보다 뛰어난 성능을 보였습니다.