TL;DR

  • Nari Qwen3-ASR가 폐쇄형 모델과 경쟁 가능한 정확도를 유지하면서 Coval 벤치마크 기준 약 4% WER·상위 5위, 50ms 미만 지연·1위, 시간당 0.06달러·최저가를 달성하는 맞춤형 추론 엔진임
  • Qwen3-ASR는 6개월 넘게 Hugging Face Open ASR 리더보드 상위 10위를 유지한 모델임
  • 맞춤형 추론 엔진은 정확도를 보존하면서 속도와 비용 효율을 개선하는 구조임
  • Nari Qwen3-ASR의 Fast·Standard 엔드포인트가 제한된 기간 동안 무료 공개 베타로 제공됨
  • 무료 베타는 두 ASR 엔드포인트에 공유되는 조직 단위 동시성 2건, 엔드포인트별 일일 최대 100건 요청 제한과 비보장 SLO가 적용됨

맞춤형 추론 엔진과 성능

  • Qwen3-ASR는 폐쇄형 모델과 경쟁 가능한 성능을 보이며 6개월 넘게 Hugging Face Open ASR 리더보드 상위 10위에 속한 모델임
  • 추론 지원이 뒤처진 문제에 대응해 정확도를 유지하면서 속도와 비용 효율을 높이는 맞춤형 추론 엔진을 구축함
  • Coval 벤치마크 기준 성능은 다음과 같음
  • 정확도: 약 4% 단어 오류율(WER)로 상위 5위이며 Gemini Transcribe 3.5, Cartesia Ink 2, ElevenLabs Scribe v2 RT보다 우수함
  • 속도: 최종 세그먼트 도달 시간(time-to-final segment) 50ms 미만으로 1위임
  • 가격: 모든 스트리밍 음성-텍스트 변환(STT) 모델 중 최저가인 시간당 0.06달러

공개 베타와 이용 조건

  • Nari Qwen3-ASR가 공개 베타에 진입하며 Fast와 Standard 엔드포인트를 제한된 기간 동안 누구나 무료로 이용할 수 있음
  • 낮은 비용과 지연시간을 갖춘 멀티모달리티가 더 많은 애플리케이션을 현실화할 수 있다는 관점임
  • 무료 공개 베타 계정에는 두 ASR 엔드포인트에 공유되는 조직 단위 동시성 제한 2건이 적용됨
  • 일일 요청 한도는 엔드포인트별로 별도 적용됨
  • qwen3-asr-fast:free: 하루 최대 100건
  • qwen3-asr:free: 하루 최대 100건
  • 무료 엔드포인트는 최선 노력(best-effort) 방식으로 제공되며 가동 시간과 지연시간을 포함한 서비스 수준 목표(SLO)를 보장하지 않음

고동시성 지원과 얼리 액세스

  • 고동시성 지원은 파트너를 시작으로 단계적으로 확대 중이며 가능한 한 빠르게 정식 출시(GA)할 계획임
  • 얼리 액세스에 관심이 있는 경우 founders@narilabs.com으로 문의 가능함