언어 바꾸기English
이전 목록

센스타임, 통합 비전 모델 ‘SenseNova-Vision’ 오픈소스 공개

SenseTime open-sources SenseNova-Vision unified vision model

TL;DR AI

핵심 요약

1분
  1. 센스타임이 통합 멀티모달 비전 모델인 SenseNova-Vision을 완전 오픈소스로 공개했다.

  2. 이 모델은 객체 탐지, OCR, 분할, 깊이 추정, 3D 재구성, 표면 법선 예측, 다중 시점 기하 등 여러 작업을 처리한다.

  3. 센스타임은 5,000만 샘플 규모의 SenseNova-Vision Corpus-50M 데이터셋도 함께 공개하고, 이를 SenseNova U-series에 통합할 계획이다.

  4. 이번 공개는 작업별로 분리된 컴퓨터 비전 시스템 의존을 줄이고 멀티모달 AI 도입을 앞당길 수 있다.

원문 보기