Pulse · AI 뉴스

OpenSkillRisk: 실제 위험한 서드파티 스킬을 활용한 에이전트 안전성 벤치마크

OpenSkillRisk · 2026-07-22

OpenSkillRisk는 LLM 기반 에이전트가 서드파티 스킬을 활용할 때 발생할 수 있는 안전성 위험을 평가하는 벤치마크입니다.

263개의 위험한 스킬을 수집하여 7가지 유형으로 분류하고, 표준화된 사용자 작업과 샌드박스를 통해 안전성을 평가합니다.

실험 결과, 현재 에이전트 시스템은 위험한 스킬을 안정적으로 처리하지 못하며, 약 17%의 경우에 안전하지 않은 동작을 수행합니다.

##에이전트##안전##벤치마크##OpenSkillRisk##LLM
매일 핵심 AI 소식을 한국어로, 빠르게
App Store 에서 Pulse 받기 앱에서 열기