다중 에이전트 자동 연구 시스템을 위한 어휘
A Vocabulary for Multi-Agent Automated Research Systems
TL;DR AI
1분핵심 요약
저자는 다중 에이전트 자동화 연구 시스템을 평가하기 위한 새 용어로 ‘Generative taste’와 ‘Evaluative taste’를 제안한다.
Generative taste는 새 연구 방향을 떠올리는 능력, Evaluative taste는 결과를 정확히 판단하는 능력을 뜻한다.
이 제안은 벤치마크가 아니라 시스템을 명세하는 언어에 가깝고, 여러 사례 연구로 보강된다.
핵심은 아이디어 생성과 평가 품질을 분리해, 에이전트 파이프라인의 실패 원인을 더 정확히 진단하자는 것이다.
