ResearchMath-14K: 에이전트를 통한 연구 수준 수학의 확장
ResearchMath-14K: Scaling Research-Level Mathematics via Agents
TL;DR AI
2분핵심 요약
연구진은 학술 자료를 바탕으로 다중 에이전트 파이프라인으로 구축한 14,056문항 규모의 연구 수준 수학 데이터셋 ResearchMath-14K를 공개했다.
또한 두 개의 오픈 모델에서 생성한 22만 개의 추론 궤적 ResearchMath-Reasoning을 만들어, 고난도 수학 문제에 대한 모델의 접근 방식을 분석했다.
분석 결과, 풀이를 아예 시도하지 않거나 존재하지 않는 인용을 만들어내는 등 여러 실패 패턴이 자주 나타났고, 연구진은 이를 걸러냈다.
필터링한 데이터를 사용해 Qwen3 4B~30B 모델을 미세조정한 결과, 평균 성능이 9.2포인트 향상됐다.
이번 연구는 공개된 연구 수준 수학 데이터로는 가장 큰 규모를 제시하며, 불완전한 풀이 시도도 강력한 추론 모델 학습에 도움이 될 수 있음을 보여준다.
