METR, AI 에이전트가 인간보다 더 비싸지는 시점을 정확히 계산하는 새 지표 도입
METR introduces a new metric to calculate exactly when AI agents become more expensive than humans

TL;DR AI
1분핵심 요약
METR는 AI 에이전트와 인간 노동을 같은 성능 향상 기준으로 비교하는 새로운 ‘지출 한계(expenditure horizon)’ 지표를 제안했다.
NanoGPT speedrun에 적용한 결과, 인간의 1% 속도 향상에 드는 노력은 약 2,500달러로 추정됐다.
여러 AI 모델은 개선 폭이 작았고, 지출 한계는 0달러에서 3,300달러까지 다양했다.
특히 구형 모델들은 노이즈를 넘어서지 못한 경우가 많았고, 최신 모델들도 비용 효율성 차이가 컸다.
