빠른 이미지 및 비디오 생성을 위한 병렬 디코딩 증류
Parallel Decoding Distillation for Fast Image and Video Generation
TL;DR AI
1분핵심 요약
연구진은 확산 및 플로우 기반 이미지·비디오 생성을 더 빠르게 만드는 더 단순한 학습 기법, Parallel Decoding Distillation을 제안했다.
이 방법은 한 번의 평가로 여러 개의 디노이징 단계를 예측해, 사전학습된 모델의 샘플링 속도를 높인다.
여러 텍스트-이미지 및 텍스트-비디오 시스템에서 4~8회 네트워크 평가만으로 최신 수준의 성능을 보고했다.
또한 모드 붕괴를 줄이고 모션 다양성을 높여, 고품질의 빠른 생성 기술이 실제 배포에 더 가까워졌다.
