왜 언어 모델은 환각을 일으키는가
Why language models hallucinate

TL;DR AI
1분핵심 요약
OpenAI는 언어 모델의 환각이 불확실할 때 모르는 척하기보다 추측을 보상하는 기존 학습·평가 방식에서 비롯된다고 설명했다.
GPT-5는 이전 모델보다 환각이 줄었지만, 특히 어렵거나 모호한 질문에서는 여전히 문제가 남아 있다고 밝혔다.
핵심은 정확도만 보는 벤치마크가 자신 있게 틀리는 답을 강화할 수 있어, 평가 기준과 인센티브를 바꿔야 한다는 점이다.



