AMD, NVIDIA의 Groq 투자에 맞불… Cerebras 웨이퍼 스케일 엔진을 Helios와 결합해 와트당 토큰 처리량 5배 향상
AMD Fires Back At NVIDIA’s Groq Bet, Fuses The Cerebras Wafer-Scale Engine With Helios For 5x Higher Tokens Per Second Per Watt

TL;DR AI
1분핵심 요약
AMD가 Cerebras와 협력해 Helios 랙 스케일 시스템과 Wafer-Scale Engine을 결합, AI 추론 성능을 높입니다.
목표는 지연시간과 효율, 토큰 처리량 개선이며, 최대 5배의 tokens per second per watt 향상을 내세우고 있습니다.
이번 협력은 NVIDIA 연계 추론 스택과 Groq 같은 경쟁사에 맞서는 AMD의 대안 플랫폼 강화로 해석됩니다.
성공할 경우 고객은 저지연 토큰 생성에 더 유연하고 고성능인 AI 가속 플랫폼을 선택할 수 있게 됩니다.



