TL;DR

  • GPT-6 Sol은 복잡한 코딩과 에이전트 워크플로를 위한 모델이며 1,050,000 토큰 컨텍스트128,000 토큰 최대 출력을 제공함
  • 추론 강도는 none, low, medium(기본값), high, xhigh, max를 지원하며, Responses API에서 기본 도구와 함수 호출을 사용할 수 있음
  • 입력 가격은 1M 토큰당 2달러, 출력 가격은 10달러이며, 캐시 입력은 0.20달러, 캐시 쓰기는 2.50달러
  • 텍스트 입력·출력과 이미지 입력을 지원하고, 스트리밍·함수 호출·구조화된 출력 및 다양한 도구를 지원함
  • 모델 식별자는 gpt-6-sol이며, 사용량 등급에 따라 분당 요청 수가 500~15,000RPM, 분당 토큰 수가 500,000~40,000,000TPM으로 설정됨

모델 개요

  • GPT-6 Sol은 복잡한 코딩과 에이전트 워크플로를 지원하도록 설계된 모델임
  • 추론 강도(reasoning.effort)는 none, low, medium(기본값), high, xhigh, max
  • 기본 제공 도구와 함수 호출에는 Responses API 사용이 권장됨
  • Chat Completions API에서는 reasoning_effortnone으로 설정한 경우에만 함수 호출이 지원됨
  • 유럽연합 데이터 레지던시는 Standard 처리에서만 이용 가능함
  • 컨텍스트 윈도우는 1,050,000 토큰
  • 최대 출력은 128,000 토큰
  • 지식 기준일은 2026년 4월 20일
  • 추론 토큰을 지원함

가격

  • 가격은 사용한 토큰 수 또는 모델 유형에 따른 다른 지표를 기준으로 책정됨
  • 검색과 컴퓨터 사용 같은 도구 전용 모델은 도구 호출당 요금이 부과됨
  • 텍스트 토큰 기준 가격은 다음과 같음
  • 입력: 1M 토큰당 2.00달러
  • 캐시 입력: 1M 토큰당 0.20달러
  • 캐시 쓰기: 1M 토큰당 2.50달러
  • 출력: 1M 토큰당 10.00달러
  • 캐시 입력 토큰은 캐시되지 않은 입력 가격의 10%로 책정됨
  • 캐시 쓰기는 캐시되지 않은 입력 가격의 1.25배로 청구됨
  • 입력 토큰이 272,000개를 초과하는 프롬프트는 전체 요청에 대해 입력·캐시 요금이 2배, 출력 요금이 1.5배로 적용됨
  • 이용 가능한 경우 지역 처리에는 10%의 추가 요금이 붙음
  • 유럽연합 데이터 레지던시는 Standard 처리에서만 이용 가능함
  • Batch와 Flex는 Standard 요금의 50%로 책정됨
  • Fast 모드는 해당 요금의 2배로 책정됨

지원 양식

  • 입력 및 출력: 텍스트
  • 입력: 이미지
  • 오디오: 지원되지 않음
  • 비디오: 지원되지 않음

엔드포인트

  • Live: v1/live/sessions
  • Chat Completions: v1/chat/completions
  • Responses: v1/responses
  • Realtime: v1/realtime
  • Realtime 번역: v1/realtime/translations
  • Realtime 전사: v1/realtime/transcription_sessions
  • Assistants: v1/assistants
  • Batch: v1/batch
  • 미세 조정: v1/fine-tuning
  • 임베딩: v1/embeddings
  • 이미지 생성: v1/images/generations
  • 동영상: v1/videos
  • 이미지 편집: v1/images/edits
  • 음성 생성: v1/audio/speech
  • 전사: v1/audio/transcriptions
  • 번역: v1/audio/translations
  • 조정: v1/moderations
  • 레거시 Completions: v1/completions

기능

  • 스트리밍: 지원됨
  • 함수 호출: 지원됨
  • 구조화된 출력: 지원됨
  • 미세 조정: 지원되지 않음

지원 도구

  • 다음 도구는 Responses API 사용 시 지원됨
  • 웹 검색
  • 파일 검색
  • 이미지 생성
  • 코드 인터프리터
  • 호스팅 셸
  • 패치 적용
  • 스킬
  • 컴퓨터 사용
  • MCP
  • 도구 검색

모델 식별자

  • API 요청에는 gpt-6-sol을 사용함
  • 모델 식별자: gpt-6-sol

사용량 제한

  • 사용량 제한은 일정 기간 내 요청 수, 토큰 수, 오디오 길이 또는 기타 사용량에 상한을 설정해 공정하고 안정적인 API 접근을 보장함
  • 사용 등급에 따라 제한 수준이 결정되며, 요청과 지출이 늘어나면 자동으로 상향됨
  • Tier 1: 500RPM, 500,000TPM, Batch 대기열 한도 1,500,000
  • Tier 2: 5,000RPM, 1,000,000TPM, Batch 대기열 한도 3,000,000
  • Tier 3: 5,000RPM, 2,000,000TPM, Batch 대기열 한도 100,000,000
  • Tier 4: 10,000RPM, 4,000,000TPM, Batch 대기열 한도 200,000,000
  • Tier 5: 15,000RPM, 40,000,000TPM, Batch 대기열 한도 15,000,000,000
  • Free 등급은 지원되지 않음