inclusionAI가 에이전트 기반 디퓨전 언어 모델 LLaDA2.2-flash를 공개했어요.
LLaDA2.2-flash는 Levenshtein Editing을 도입해 긴 컨텍스트 환경에서 도구 사용, 다중 턴 상호작용, 오류 수정 기능을 지원해요.
128K 토큰 컨텍스트를 지원하며, Block Routing을 통해 MoE 전문가 활성화를 제어해 효율성을 높였어요.
DELETE, INSERT 제어 토큰을 활용해 시퀀스 구조 편집, 불필요한 내용 제거, 삽입 슬롯 생성 기능도 제공돼요.