언어 바꾸기English
이전 목록

AgentHOI: 암묵적 표현 정렬을 통한 인간-객체 상호작용 비디오 생성을 위한 다중 에이전트 추론

AgentHOI: Multi-Agent Reasoning for Human-Object-Interaction Video Generation via Implicit Representation Alignment

TL;DR AI

핵심 요약

1분
  1. 연구진이 텍스트 기반 인간-객체 상호작용(HOI) 비디오 생성 기법인 AgentHOI를 제안했다.

  2. 이 방법은 비디오 생성 전에 인식, 상호작용, 모션을 다단계 에이전트 추론으로 계획한다.

  3. 또한 암묵적 텍스트-모션 정렬을 학습해, 추론 시 명시적 모션 입력 의존도를 줄였다.

  4. 이를 통해 복잡한 상호작용 장면의 생성이 더 정교하고 확장 가능하며 실용적으로 개선된다.

원문 보기