AI 모델은 종종 정답을 내지만 잘못된 출처를 가리킨다
AI models often give the right answers but point to the wrong sources

TL;DR AI
1분핵심 요약
CiteVQA는 답변의 정답 여부와 함께 문서 내 정확한 근거 위치까지 제대로 인용하는지 평가하는 새로운 벤치마크다.
20개 멀티모달 모델을 시험한 결과, 정답은 맞히면서도 페이지·문단·표·그림의 정확한 위치는 못 짚는 경우가 많아 큰 격차가 드러났다.
연구진은 소스 위치를 찾는 능력이 핵심 병목이며, 더 나은 검색이 성능을 크게 높인다고 밝혔다.
법·금융·의료처럼 민감한 분야에서는 답이 맞는 것만으로는 부족하고, 올바른 증거로 추적 가능해야 한다.
