TL;DR

  • VideoRouter가 Sora, Kling, Veo, MiniMax 등 15개 이상 동영상 모델과 이미지 모델을 단일 API로 연결하고, 요청마다 최저가 호스트를 선택함.
  • 플랫폼 수수료는 OpenRouter의 5%보다 낮은 고정 2%이며, 모델별 가격·지연 시간·품질을 투명하게 비교할 수 있음.
  • Fal, WaveSpeedAI, Atlas Cloud, Replicate, Novita AI 등 여러 호스트를 대상으로 가격·성능·상태를 자동 최적화하고 장애 발생 시 자동 전환함.
  • 비용 절감은 직접 협상한 대량 요금, 최저가 호스트 라우팅, 실시간 가격 동기화, 배치 처리, 오픈 모델 직접 운영, 낮은 수수료의 6가지 방식으로 이뤄짐.
  • OpenAI 호환 API를 사용하므로 기본 주소와 API 키만 바꾸면 동영상·이미지 모델을 기존 요청 형식으로 호출할 수 있음.

모든 동영상·이미지 모델을 위한 단일 API

  • 항상 최저가를 찾는 방식으로 동작함.
  • 단일 인터페이스를 통해 Sora, Kling, Veo, MiniMax 및 15개 이상 동영상 모델에 접근함.
  • 플랫폼 수수료는 모든 요청에 적용되는 고정 2%이며, OpenRouter의 5%와 비교됨.
  • 각 모델의 가격, 지연 시간, 품질을 투명하게 확인할 수 있음.
  • 가장 낮은 가격의 최적 모델에 출시 첫날부터 접근할 수 있음.

지원 모델

  • 텍스트에서 동영상: MiniMax H3 Turbo
  • 이미지에서 동영상: Seedance 2.5
  • 텍스트에서 동영상: Wan 3.0
  • 이미지에서 동영상: Kling 2.5
  • 텍스트에서 동영상: Veo 3
  • 텍스트에서 동영상: Sora 2
  • 텍스트에서 이미지: Seedream 5.0 Pro
  • 텍스트에서 이미지: GPT Image 2

아키텍처

또 다른 라우터가 아닌 최적화 계층

  • 하나의 엔드포인트로 모든 모델에 연결되며, 가동 시간을 최대화함.
  • Fal, WaveSpeedAI, Atlas Cloud, Replicate, Novita AI 및 그 밖의 호스트를 비교해 모든 모델과 요청마다 최저가를 찾음.
  • 모든 호스트의 상태를 지속적으로 확인해 애플리케이션이 자동으로 다른 호스트로 전환되고 계속 온라인 상태를 유지하도록 함.
  • 애플리케이션과 여러 동영상·이미지 호스트 사이에 VideoRouter 추론 최적화 계층이 위치함.
  • 최적화 기준은 비용, 지연 시간, 신뢰성, 실행 상태임.
  • 연결 대상에는 Fal, WaveSpeedAI, Atlas Cloud, Replicate, Novita AI 및 모든 동영상·이미지 호스트가 포함됨.

계층 내부의 비용 최적화

비용을 낮추는 여섯 가지 방식

  • 낮은 가격 직접 협상: 그래픽 처리 장치 호스팅 제공업체와 직접 대량 요금을 협상해 직접 이용하는 것보다 저렴한 요금을 제공함.
  • 모델별 최저가 호스트 라우팅: Wan, HunyuanVideo, MiniMax H3 같은 동일한 오픈 가중치 모델이 여러 제공업체에서 서로 다른 가격으로 호스팅되므로, 현재 가장 저렴하고 정상 상태인 호스트로 모든 생성을 라우팅함.
  • 실시간 가격 추적: 동영상·이미지 호스트의 생성별 및 초당 요금이 계속 바뀌므로 모든 제공업체의 가격을 지속적으로 다시 동기화해 오래된 가격으로 인한 과금을 방지함.
  • 긴급하지 않은 렌더링 일괄 처리: 지연 시간에 민감하지 않은 동영상·이미지 작업을 제공업체의 할인된 일괄 처리 대기열로 보내고 절감액을 그대로 반영함.
  • 오픈 소스 모델 직접 제공: 일부 오픈 가중치 체크포인트는 직접 운영해 재판매업체의 추가 요금을 제거함.
  • 낮은 수수료: 모든 렌더링과 모델에 고정 2% 플랫폼 수수료만 부과하며, OpenRouter의 5%와 비교됨.

전체 최적화 계층

  • 복잡한 처리는 자동으로 숨기고 결과만 제공함.
  • 아래 기능은 모든 요청에서 고정 2% 수수료로 자동 실행됨.
  • 원하는 모델을 기준으로 모든 제공업체의 가격, 지연 시간, 품질을 실시간으로 한곳에서 확인할 수 있어 가장 저렴하거나 빠른 제공업체를 추측할 필요가 없음.
  • 비용 최적화: 요청한 해상도와 재생 시간으로 해당 모델을 제공하는 최저가 호스트를 기준으로 모든 렌더링 가격을 자동 산정함.
  • 지출 통제: 키, 프로젝트, 팀별 예산과 한도를 설정하고 지출이 통제 불능 상태가 되기 전에 알림을 받음.
  • 모델 라우팅: Fal, WaveSpeedAI, Atlas Cloud, Replicate, Novita AI와 Sora, Veo, Kling 같은 비공개 호스트를 포함한 모든 동영상·이미지 모델을 하나의 API로 제공함. 문자열 하나를 바꿔 모델을 교체할 수 있음.
  • 재시도 및 장애 전환: 렌더링 중 호스트 성능이 저하되거나 요청 제한이 발생하면 자동으로 다른 호스트로 전환해 애플리케이션에 장애가 노출되지 않도록 함.
  • 가격·지연 시간·품질 통합 비교: 특정 모델을 호스팅하는 모든 제공업체의 실시간 가격, 측정된 지연 시간, 벤치마크 품질을 나란히 보여줘 실제로 가장 저렴하고 빠른 제공업체를 확인할 수 있음.
  • 성능 최적화: 호스트별 지연 시간과 처리량을 추적해 현재 렌더링에 가장 빠른 호스트로 라우팅함.

빠른 시작

  • 이미 OpenAI SDK를 사용 중이라면 기본 주소 한 줄만 변경하면 됨.
  • 기본 주소를 VideoRouter로 지정하고 오픈 소스 또는 비공개 동영상·이미지 모델을 직접 호출할 수 있으며, 요청 형식은 동일하고 API 키 하나와 고정 2% 수수료가 적용됨.
  • OpenAI 호환 방식이므로 코드를 다시 작성할 필요가 없음.
  • 어떤 호스트의 키든 사용할 수 있으며, 자체 키를 가져올 수도 있음.
  • 모든 요청에 2% 수수료가 적용되며, OpenRouter의 5%와 비교됨.
  • 제공된 호출 예시는 openai를 설치한 뒤 https://videorouter.sh/api/v1을 기본 주소로 지정하고 API 키를 설정하는 방식임.
  • 예시는 wan-2.2 모델에 밤의 네온 조명 도시 위를 비행하는 드론 촬영 장면을 요청하고, 길이를 5초로 설정함.
  • 생성 요청은 하나의 API 키로 처리되며, 현재 Wan 2.2를 가장 저렴하게 제공하는 호스트로 자동 라우팅됨.

한 번 연결하고 나머지는 계층에 맡기는 방식

  • 개발자 계정을 만들고 API 키를 발급한 뒤 OpenAI SDK가 VideoRouter를 가리키도록 설정하면 됨.
  • 이후 모든 동영상·이미지 호스트, 가격, 지연 시간, 장애 전환이 자동으로 최적화됨.
  • OpenAI 호환 방식, API 키 하나, 2% 수수료 구조임.