언어 바꾸기English
이전 목록

PolyAI, 대화형 음성 모델 ‘Dialog-RSN-1’ 공개… 턴테이킹·음성 인식·함수 호출·응답을 통합

PolyAI Releases Dialog-RSN-1: An Audio-Native Dialog Model That Fuses Turn-Taking, Speech Recognition, Function Calling, and Response

TL;DR AI

핵심 요약

1분
  1. PolyAI가 실시간 음성 에이전트를 위한 오디오 네이티브 엔터프라이즈 대화 모델 Dialog-RSN-1을 공개했다.

  2. 이 모델은 원시 오디오를 직접 입력받아 턴테이킹, 음성 인식(ASR), 함수 호출, 응답 생성을 하나의 파이프라인에서 처리한다.

  3. PolyAI는 실제 고객 배포에서 300ms 미만의 응답 속도와 더 나은 문의 해결률, 낮은 지연시간을 달성했다고 밝혔다.

  4. 출시 시점에는 영어만 지원하며, 오픈 웨이트나 공개 API 없이 PolyAI 플랫폼을 통해서만 제공된다.

원문 보기