언어 바꾸기English
이전 목록

Google DeepMind, 멀티모달 생성 모델 ‘Gemini Omni’ 발표… 자연어 대화와 추론으로 영상 생성·편집 가능

Google DeepMind announces multimodal generative model “Gemini Omni,” enabling video generation and editing through natural-language dialogue and reasoning

TL;DR AI

핵심 요약

1분
  1. Google DeepMind가 다양한 입력으로 영상 생성과 편집을 할 수 있는 새 멀티모달 모델 패밀리 Gemini Omni를 공개했다.

  2. 이 모델은 참조 자료를 반영한 편집, 자연어 기반 제어, 그리고 사용자의 목소리를 활용한 AI 아바타 기능을 지원한다.

  3. Google은 생성된 영상에 투명성을 위한 SynthID 워터마크를 적용한다고 밝혔다.

  4. 이번 발표는 창작자와 일반 사용자 모두에게 텍스트 중심의 일관된 영상 제작을 더 실용적으로 만드는 데 초점을 맞췄다.

원문 보기