DiLA: 분리된 잠재 행동 월드 모델
DiLA: Disentangled Latent Action World Models

TL;DR AI
1분핵심 요약
연구진은 라벨 없는 비디오로 학습하는 자기지도 세계모델 DiLA를 소개했다.
DiLA는 콘텐츠와 구조를 분리해 연속적이고 의미적으로 정리된 잠재 행동을 학습한다.
이를 통해 행동 추상화를 개선하면서도 생성 품질을 유지해 고품질 비디오 합성을 가능하게 했다.
이 접근은 비디오 기반 세계모델을 계획, 시뮬레이션, 행동 전달에 더 유용하게 만들 수 있다.
