언어 바꾸기English
이전 목록

왜 추론 모델이 모든 것을 바꿨나요

Why Reasoning Models Changed Everything

TL;DR AI

핵심 요약

1분
  1. OpenAI는 2024년 9월 o1을, DeepSeek는 2025년 1월 R1을 출시했다.

  2. Kaplan et al. 논문은 언어 모델 성능이 학습 컴퓨트에 따른 거듭제곱 법칙을 따른다고 보고했다.

  3. 2022년 Google Brain의 Wei et al.은 단계별 추론이 수학·논리 과제를 개선한다고 보였다.

  4. chain-of-thought prompting은 2022년부터 있었고, 추론 토큰은 임시 메모장처럼 쓰일 수 있다.

  5. OpenAI의 o1 시스템 카드는 강화학습으로 답변 전 chain-of-thought를 만들도록 훈련했다고 밝혔다.

원문 보기