TL;DR
- Nari Qwen3-ASR가 폐쇄형 모델과 경쟁 가능한 정확도를 유지하면서 Coval 벤치마크 기준 약 4% WER·상위 5위, 50ms 미만 지연·1위, 시간당 0.06달러·최저가를 달성하는 맞춤형 추론 엔진임
- Qwen3-ASR는 6개월 넘게 Hugging Face Open ASR 리더보드 상위 10위를 유지한 모델임
- 맞춤형 추론 엔진은 정확도를 보존하면서 속도와 비용 효율을 개선하는 구조임
- Nari Qwen3-ASR의 Fast·Standard 엔드포인트가 제한된 기간 동안 무료 공개 베타로 제공됨
- 무료 베타는 두 ASR 엔드포인트에 공유되는 조직 단위 동시성 2건, 엔드포인트별 일일 최대 100건 요청 제한과 비보장 SLO가 적용됨
맞춤형 추론 엔진과 성능
- Qwen3-ASR는 폐쇄형 모델과 경쟁 가능한 성능을 보이며 6개월 넘게 Hugging Face Open ASR 리더보드 상위 10위에 속한 모델임
- 추론 지원이 뒤처진 문제에 대응해 정확도를 유지하면서 속도와 비용 효율을 높이는 맞춤형 추론 엔진을 구축함
- Coval 벤치마크 기준 성능은 다음과 같음
- 정확도: 약 4% 단어 오류율(WER)로 상위 5위이며 Gemini Transcribe 3.5, Cartesia Ink 2, ElevenLabs Scribe v2 RT보다 우수함
- 속도: 최종 세그먼트 도달 시간(time-to-final segment) 50ms 미만으로 1위임
- 가격: 모든 스트리밍 음성-텍스트 변환(STT) 모델 중 최저가인 시간당 0.06달러임
공개 베타와 이용 조건
- Nari Qwen3-ASR가 공개 베타에 진입하며 Fast와 Standard 엔드포인트를 제한된 기간 동안 누구나 무료로 이용할 수 있음
- 낮은 비용과 지연시간을 갖춘 멀티모달리티가 더 많은 애플리케이션을 현실화할 수 있다는 관점임
- 무료 공개 베타 계정에는 두 ASR 엔드포인트에 공유되는 조직 단위 동시성 제한 2건이 적용됨
- 일일 요청 한도는 엔드포인트별로 별도 적용됨
qwen3-asr-fast:free: 하루 최대 100건qwen3-asr:free: 하루 최대 100건- 무료 엔드포인트는 최선 노력(best-effort) 방식으로 제공되며 가동 시간과 지연시간을 포함한 서비스 수준 목표(SLO)를 보장하지 않음
고동시성 지원과 얼리 액세스
- 고동시성 지원은 파트너를 시작으로 단계적으로 확대 중이며 가능한 한 빠르게 정식 출시(GA)할 계획임
- 얼리 액세스에 관심이 있는 경우
founders@narilabs.com으로 문의 가능함
댓글 (0)
로그인하면 이 기사에 내 생각을 남길 수 있어요