NVIDIA와 메릴랜드대 연구진, 초강력 오픈 대형 오디오-언어 모델 Audio Flamingo Next(AF-Next) 공개
NVIDIA and University of Maryland Researchers Release Audio Flamingo Next (AF-Next): A Super Powerful Open Large Audio-Language Model

TL;DR AI
1분핵심 요약
NVIDIA와 메릴랜드대 연구진이 음성, 환경음, 음악을 이해하는 오픈 대형 오디오-언어 모델 Audio Flamingo Next(AF-Next)를 공개했다.
AF-Next는 지시 수행, 다단계 추론, 오디오 캡셔닝용 변형 모델을 제공하며, 긴 문맥과 타임스탬프 기반 시간 추론을 지원한다.
대규모 오디오 데이터로 학습돼 긴 오디오 입력에 대한 질의응답과 추론 성능을 높였으며, 오픈소스 멀티모달 AI의 진전을 보여준다.
