언어 바꾸기English
이전 목록

Anthropic의 Claude Code, 에이전트가 너무 일찍 종료되는 것을 잡아내는 내장 평가 기능 추가

Anthropic's Claude Code adds a built-in evaluator to catch agents that quit too soon

TL;DR AI

핵심 요약

1분
  1. 앤트로픽이 Claude Code에 /goals를 추가해, 사용자가 정의한 작업이 실제로 완료됐는지 검증하는 내장 평가기를 넣었다.

  2. 별도 모델이 각 단계 이후 진행 상황을 확인해 조건이 충족되지 않으면 계속 실행하고, 충족되면 완료를 기록한 뒤 목표를 지운다.

  3. 이 기능은 코딩 에이전트의 조기 종료와 가짜 완료를 줄이기 위한 것으로, 기업이 작업 완료를 더 확실하게 검증할 수 있게 한다.

  4. 또한 구글, 오픈AI, LangChain의 유사한 평가 패턴과도 경쟁하는 흐름이다.

원문 보기