시스템 프롬프트를 넘어서: 기업용 AI 에이전트에서 정책과 행동 경계 강제하기
Beyond System Prompts: Enforcing Policy & Action Boundaries in Enterprise AI Agents

TL;DR AI
1분핵심 요약
기업은 자율형 AI 에이전트의 안전을 시스템 프롬프트만으로 보장해서는 안 된다고 지적합니다.
기사에서는 에이전트에게 무엇을 지시하는지가 아니라, 무엇을 할 수 있는지를 결정론적 런타임 제어로 제한해야 한다고 권고합니다.
에이전트 행위를 4단계 위험 모델로 나누고, 단순 스키마 검증부터 비가역적 작업의 인간 승인까지 적용하라고 제안합니다.
권장되는 통제 수단은 JSON Schema 검증, OPA·CEL 기반 정책 엔진, 그리고 고위험 작업에 대한 Human-in-the-Loop 승인입니다.
