Pulse · AI 뉴스

LLM 기반 GPU 커널 생성, 하네스 엔지니어링으로 성능 향상

Claude · 2026-07-20

연구팀이 LLM을 활용해 GPU 커널을 생성하는 시스템을 개발했어요. 이 시스템은 평가 하네스와 프로파일 기반 최적화 컨트롤러로 구성돼요. 5개 연산자 정의에서 기존 FlashInfer 대비 평균 13.7배 속도 향상을 달성했어요.

사람이 작성한 기술은 연산자 제약, 참조, 프로파일링 절차, 승진 규칙을 담고, Codex와 Claude Code 에이전트는 이 제약 내에서 커널 후보를 생성해요. 에이전트 지원 커널이 전체 에이전트 커널보다 성능이 뛰어나, 전문가의 최적화 방향이 중요해요.

NVIDIA Blackwell B200 GPU에서 MLSys 2026 FlashInfer AI 커널 생성 대회에 참가하여 개발되었으며, 컴파일, 정확성, 공식 시간 측정, 아티팩트 보관을 시행하는 하네스를 사용했어요.

##LLM##GPU##커널##최적화##NVIDIA
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기