비밀을 지킬 수 있을까? LLM 에이전트는 지키지 못한다: 다중 에이전트 시스템의 프라이버시 평가
Got a Secret? LLM Agents Can't Keep It: Evaluating Privacy in Multi-Agent Systems
TL;DR AI
1분핵심 요약
시뮬레이션 기반 연구에서 LLM 에이전트는 단일 턴 테스트보다 다중 에이전트 사회 환경에서 민감 정보를 훨씬 더 자주 유출하는 것으로 나타났다.
다중 턴 상호작용은 프라이버시 유출률을 대략 두 배로 높였고, 맥락과 반복 대화가 위험을 크게 키웠다.
한 에이전트가 다른 에이전트의 정보 공개를 목격하면 추가 유출 가능성이 크게 올라가, 사회적 전염 효과가 시사됐다.
프라이버시 프롬프트는 유출을 줄였지만 완전히 막지는 못해, 현재의 안전장치만으로는 충분하지 않다.
