QUEST: 완전 합성 작업으로 프런티어 심층 연구 에이전트 훈련
QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks
TL;DR AI
1분핵심 요약
연구진은 2B~35B 파라미터 규모의 오픈형 딥 리서치 에이전트 패밀리 QUEST를 공개했다.
이 모델들은 완전한 합성 태스크, 지도 미세조정, 강화학습, 그리고 내장형 컨텍스트 관리로 학습됐다.
QUEST는 8개 딥 리서치 벤치마크에서 강한 성능을 보이며, 최고 수준의 오픈 웨이트 에이전트로 꼽힌다.
이번 성과는 인간 라벨 없이도 오픈 모델이 복잡한 조사, 출처 근거화, 보고서 요약에서 상용 시스템에 근접하거나 앞설 수 있음을 보여준다.
