Sakana AI, 실시간으로 LLM 지식을 주입하는 탠덤 음성-음성 아키텍처 ‘KAME’ 공개
Sakana AI Introduces KAME: A Tandem Speech-to-Speech Architecture That Injects LLM Knowledge in Real Time

TL;DR AI
1분핵심 요약
Sakana AI가 실시간 음성 비서용 하이브리드 음성-음성 아키텍처 KAME를 공개했다.
프런트엔드 음성 모델과 백엔드 스트리밍 LLM을 결합해, 대화 중 부분 응답 ‘오라클’을 주고받는다.
이 구조는 거의 즉각적인 음성 반응을 유지하면서 LLM 기반 추론으로 답변 품질을 높이는 것을 목표로 한다.
KAME는 대화형 AI의 핵심 과제인 ‘빠른 응답성’과 ‘더 똑똑한 답변’의 균형을 겨냥한다.
