LLM은 시간 여행을 할 수 있을까? 강화 학습을 통한 법률 에이전틱 검색의 시간적 일관성 향상
Can LLMs Time Travel? Enhancing Temporal Consistency in Legal Agentic Search through Reinforcement Learning

TL;DR AI
1분핵심 요약
연구진은 법률 LLM의 시간적 편향을 줄이기 위해 RL로 학습한 법률 에이전트 LegalSearch-R1을 제안했다.
이 시스템은 시점별로 인덱싱된 데이터, 로컬 법령 검색, 온라인 검색을 결합해 해당 개정 시기에 맞는 법과 판례를 찾는다.
이를 통해 오래된 법령이나 판례에 근거한 오류를 줄이고, 시간 일관성과 법률 추론을 개선한다.
LegalSearch-R1은 13개 법률 태스크에서 여러 기준 모델을 앞서며, 법률 벤치마크에서도 높은 성능을 보였다.
