언어 바꾸기English
이전 목록

NVIDIA, 고속·고정밀 객체 탐지 AI 모델 ‘LocateAnything’ 공개… 사진뿐 아니라 앱 UI와 문자도 탐지 가능

NVIDIA releases LocateAnything, a high-speed, high-precision object detection AI model that can also detect app UIs and text, not just photos

TL;DR AI

핵심 요약

1분
  1. NVIDIA가 사진, 스크린샷, 문서 속 대상을 빠르게 찾아내는 비전-언어 모델 LocateAnything을 공개했다.

  2. 이 모델은 UI 요소와 문자 검출도 지원하며, 세밀한 대상 인식에서 Qwen3-VL과 Rex-Omni보다 우수한 성능을 보였다.

  3. Hugging Face에서 데모를 제공하고 있으며, 모델 본체도 공개됐다.

  4. 이 기술은 로봇 제어, PC 자동화, UI 분석 등 실시간 인지 작업의 응답성과 정확도를 높일 수 있다.

원문 보기