구글의 AI 개요는 열 번 중 아홉 번 정확하다고 연구 결과
Google's AI Overviews are correct nine out of ten times, study finds

TL;DR AI
2분핵심 요약
연구는 SimpleQA 벤치마크로 4,326건의 Google 검색을 검사했다.
10월 라운드에서 Gemini 2는 85% 정답률, 2월 라운드에서 Gemini 3는 91% 정답률을 보였다.
연구 초점은 AI 개요의 정확성과 검증 가능성이며, 구글은 모든 AI 생성 응답에 오류 가능성 면책 문구를 표시한다.
검증 가능성은 악화됐다: 정답이지만 근거 없는 비율이 Gemini 2의 37%에서 Gemini 3의 56%로 증가했다.
구글이 인용한 5,380개 출처 중 Facebook과 Reddit이 자주 등장했으며, Facebook은 정답에서 5%, 오답에서 7%를 차지했다; 오류 사례로는 Yo-Yo Ma 수상 기록 오류, 강 이름 오독, Bob Marley 박물관 개관연도 오류 등이 있다.



