연구진이 스웨덴 의료 면허 시험을 통과한 오픈 웨이트 LLM을 개발했어요. SFT(Supervised Fine-Tuning)와 RLVR(Reinforcement Learning from Verified Rewards) 기법을 활용해 학습했어요. 이 모델은 의료 지식과 추론 능력을 평가하는 시험에서 합격점을 받았습니다.
기존 LLM은 환자 기록 요약, 진단 제안 등 의료 분야에 제한적으로 활용됐지만, 이번 연구는 의료 면허 시험 합격을 통해 LLM의 잠재력을 보여줬어요.