인셉션이 음성 에이전트용 확산 언어모델 Mercury Voice를 기업 고객에게 출시했습니다. 회사 측 테스트는 첫 응답 토큰 중앙 지연이 320ms 미만이며 긴 프롬프트와 도구 호출에서도 지연을 낮췄다고 설명합니다. OpenAI 호환 API와 기존 음성 프레임워크의 언어모델 단계에 연결할 수 있습니다. 정상 가격은 토큰 100만 개당 입력 0.40달러, 출력 1.50달러이고 출시 할인은 각각 0.20달러, 0.75달러입니다. 음성 인식, 합성, 네트워크까지 포함한 전체 서비스 성능은 별도로 측정해야 합니다.
Tech로 돌아가기
Tech
Mercury Voice 출시, 확산 언어모델로 음성 응답 지연 축소
언어모델 응답 시간과 할인 가격을 실제 음성 처리 전체의 지연, 비용과 구분해 비교해야 합니다.