언어 바꾸기English
이전 목록

상하이 AI Lab 팀, MemHarness 출시: 에이전트의 기억을 인간처럼 재구성하다

Shanghai AI Lab team launches MemHarness: Reconstructing agent memory like humans - 36Kr

TL;DR AI

핵심 요약

1분
  1. 上海AI Lab等이 MemHarness를 공개해, LLM 에이전트가 기억을 단순 주입하지 않고 먼저 비판·재구성한 뒤 행동하도록 했다.

  2. GRPO 기반 end-to-end 학습으로 현재 문맥에 맞게 과거 경험을 수정, 유지, 또는 폐기해 의사결정 품질을 높였다.

  3. ALFWorld와 WebShop에서 순수 강화학습과 정적 기억 증강 기준선을 앞섰고, 분포 밖 환경에서도 더 안정적이었다.

  4. 이 접근은 기억을 정적인 검색 결과가 아니라 문맥 인식형 재구성 과정으로 바꿔, 부정적 전이를 줄이고 일반화와 추론을 강화한다.

원문 보기