칭화대와 알리바바 공동 논문, 선형 복잡도의 비전 트랜스포머 ViT³ 소개 — CVPR 2026 구두 발표
Tsinghua and Alibaba Joint Paper Introduces ViT³: A Vision Transformer with Linear Complexity — CVPR 2026 Oral

TL;DR AI
1분핵심 요약
칭화대와 알리바바 연구진이 CVPR 2026에서 선형 추론 복잡도를 갖는 새 비전 트랜스포머 ViT³를 공개했다.
ViT³는 기존의 이차 복잡도 어텐션 대신 온라인 테스트타임 트레이닝으로 어텐션을 재해석해 연산량을 크게 줄였다.
이 모델은 여러 비전 과제에서 강한 성능을 보이면서도 기존 트랜스포머보다 훨씬 효율적이다.
덕분에 고해상도 이미지 이해를 휴대폰, 로봇, 엣지 장치에서도 더 현실적으로 활용할 수 있다.
