"AI 에이전트, 승인만으로는 못 막는다"…앤트로픽이 공개한 보안 한계
"AI agents can't be stopped by approval alone" ... Anthropic reveals security limitations

TL;DR AI
1분핵심 요약
앤트로픽이 클로드 제품군의 보안 설계와 내부 테스트 결과를 공개했다.
웹 서비스, 개발자 도구, 코워크 환경에 각기 다른 격리 방식을 적용했지만 취약점이 드러났다.
승인 남용, 프롬프트 인젝션, 잘못된 신뢰 경계로 인해 보안 구멍이 발생할 수 있음이 확인됐다.
앤트로픽은 가상머신, 네트워크 차단, 중간 프록시 등 추가 방어로 위험을 줄였다고 밝혔다.
이번 사례는 AI 에이전트가 사용자 승인만으로는 충분히 통제되지 않으며, 샌드박스와 접근 제한이 핵심임을 보여준다.



