라이터 연구진이 LLM 자체를 수정하지 않고 '하네스' 최적화만으로 토큰 소비를 최대 38% 줄이고 비용을 41% 절감하는 기술을 공개했어요. 이 기술은 AI 에이전트 서비스 비용 증가 문제를 해결하고, 기업들이 성능 향상 외에 비용 절감에 집중할 수 있도록 돕습니다.