SecRespond: 실제 침해 사고 대응을 위한 AI 에이전트 벤치마킹
SecRespond: Benchmarking AI Agents for Real-World Post-Compromise Incident Response

TL;DR AI
1분핵심 요약
연구팀은 LLM 에이전트의 침해 후 사고 대응 능력을 평가하는 첫 벤치마크인 SecRespond를 공개했다.
이 벤치마크는 10개의 사이버 레인지에서 포렌식 디스크 스냅샷, 보안 경보, 스캔, 기준선 점검을 활용한다.
23개 최첨단 모델을 시험한 결과, 경보 기반 문제는 잘 처리했지만 조용히 진행되는 침입은 자주 놓쳤다.
또한 호스트가 이미 침해된 뒤에는 완전히 검증된 복구·조치 계획을 만들어내는 데도 어려움을 보였다.
이번 결과는 AI 보안 도구의 핵심 한계를 드러낸다. 경보를 읽는 것과 신뢰할 수 있는 포렌식 대응은 다르다.
