MiniMax-M2 시리즈: 작은 활성화가 현실 세계의 최대 지능을 끌어내다
The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence
TL;DR AI
1분핵심 요약
MiniMax가 에이전트형 작업에 맞춘 M2 계열 Mixture-of-Experts 언어 모델을 공개했다.
주력 모델 M2는 총 2299억 개 파라미터를 갖지만 토큰당 98억 개만 활성화해 효율성을 높인다.
학습 체계는 에이전트가 생성한 데이터, Forge 강화학습 프레임워크, 그리고 학습 설정을 스스로 점검·조정할 수 있는 M2.7 체크포인트를 결합했다.
MiniMax는 이 모델들이 코딩, 검색, 오피스 업무, 추론 벤치마크에서 강한 성능을 보인다고 밝혔다.
