언어 바꾸기English
이전 목록

Thinking Machines, 새로운 최첨단 실시간 음성 모델 발표

Thinking Machines announced a new SOTA realtime voice model

TL;DR AI

핵심 요약

1분
  1. Thinking Machines가 음성·영상·텍스트를 아우르는 연속적 멀티모달 대화를 위한 새로운 인터랙션 모델 연구 프리뷰를 공개했다.

  2. 이 시스템은 마이크로 턴 구조와 시간 인식 인터랙션 모델, 백그라운드 추론 모델을 함께 써서 음성, 타이밍, 도구 사용을 병렬로 처리한다.

  3. 초기 결과는 기존 모델보다 지능과 상호작용 품질에서 더 뛰어난 것으로 알려졌다.

  4. 현재는 일부 연구자에게만 제한 공개됐으며, 더 넓은 제공은 올해 하반기에 예정돼 있다.

원문 보기