LLM이 독점 기술로 작동하는 것이 아니라, 대량의 독점 데이터, 즉 도난 IP를 기반으로 한다는 주장이 Reddit에 제기됐어요. Michael이라는 사용자가 LLM 학습 데이터의 저작권 문제를 지적하며, 이는 사실상 도난 IP를 활용하는 것과 같다고 주장했어요. 이 주장은 LLM 개발 과정에서 데이터 수집 및 활용에 대한 윤리적 논쟁을 다시 불러일으키고 있어요.