구글의 Gemma 4, 단일 GPU에서 최첨단 AI 구동
Google's Gemma 4 Runs Frontier AI On A Single GPU

TL;DR AI
1분핵심 요약
Google DeepMind가 Gemma 4 네 모델을 Apache 2.0으로 공개했다.
31B·26B·4B·2B 모델은 멀티모달·함수 호출·대용량 컨텍스트를 지원한다.
엔비디아와 AMD가 데이제로 최적화를 제공하고 엔비디아는 NIM·NeMo로 배포를 지원한다.
초기 테스트에서 일부 하드웨어의 추론 속도와 미세조정 문제 보고가 있었다.
퍼미시브 라이선스와 광범위한 하드웨어 지원이 온프레미스 배포를 용이하게 한다.



