OpenAI, 새 음성 모델 ‘GPT-Realtime-2’ 공개… 즉시 번역과 저지연 문자 전사도
OpenAI unveils new voice model “GPT-Realtime-2,” with instant translation and low-latency transcription

TL;DR AI
1분핵심 요약
OpenAI가 Realtime API용 새 음성 모델 3종인 GPT-Realtime-2, GPT-Realtime-Translate, GPT-Realtime-Whisper를 공개했다.
이번 모델은 음성 추론 성능, 실시간 다국어 번역, 스트리밍 음성 인식을 더 낮은 지연과 더 큰 컨텍스트 창으로 강화한다.
OpenAI는 새 모델이 Big Bench Audio와 Audio MultiChallenge 등 벤치마크에서 GPT-Realtime-1.5보다 뛰어나다고 밝혔다.
이번 업데이트로 지원, 교육, 미디어 등 실시간 소통 분야에서 더 자연스러운 음성 제품을 만들 수 있는 개발 도구가 확대됐다.



