"간결하게 말해라"에 맞서 본 Claude Code의 원시인 플러그인 벤치마크 | Hacker News
I benchmarked Claude Code's caveman plugin against "be brief." | Hacker News
TL;DR AI
1분핵심 요약
해커뉴스 토론에서 Claude Code의 응답 압축 방식 벤치마크가 다뤄졌고, Caveman 플러그인과 단순히 “be brief”를 붙이는 방식이 비교됐다.
24개 프롬프트와 5개 조건에서 두 방식은 토큰 사용량과 품질이 거의 같았고, 핵심 포인트는 모두 커버했으며 안전성 누락도 없었다.
다만 각 프롬프트-조건 조합을 한 번만 실행한 것으로 보여, 실행 간 변동성을 반영하지 못해 결과 신뢰도가 낮다는 지적이 나왔다.
이 논의는 프롬프트 해킹과 플러그인이 코딩 에이전트를 실제로 개선하는지, 그리고 벤치마크 설계가 얼마나 중요한지에 대한 의문을 제기했다.



