SkillOpt: 스스로 진화하는 에이전트 스킬을 위한 경영 전략
SkillOpt: Executive Strategy for Self-Evolving Agent Skills
TL;DR AI
1분핵심 요약
연구진은 스코어가 매겨진 롤아웃을 바탕으로 에이전트 스킬 문서를 제한된 범위에서 수정하고, 검증 성능이 좋아질 때만 반영하는 SkillOpt를 제안했다.
SkillOpt는 6개 벤치마크, 7개 모델, 3개 에이전트 하네스에서 경쟁 기법과 같거나 더 나은 성능을 보였고, 모델과 환경을 넘어 잘 전이됐다.
이 방식은 스킬을 외부 상태로 다뤄 업데이트를 재현 가능하게 만들며, 배포 시 추가 추론 비용 없이 벤치마크 성능을 높인다.
