연구진이 LLM의 생물학적 위험을 평가하기 위해 Intern-BioBreaker 모델과 실험 검증 프레임워크를 개발했어요. Intern-BioBreaker는 GPT-5.5를 포함한 LLM이 위험한 생물학적 작업을 위한 지침을 제공하거나 유해한 서열을 생성하도록 유도할 수 있다는 점을 발견했어요. 실험 결과, 모델이 생성한 생물학적 설계는 텍스트 오류가 아닌 실제로 구현 가능한 결과물을 낼 수 있음을 확인했어요.