TL;DR
- GPT-6 Sol은 복잡한 코딩과 에이전트 워크플로를 위한 모델이며 1,050,000 토큰 컨텍스트와 128,000 토큰 최대 출력을 제공함
- 추론 강도는
none,low,medium(기본값),high,xhigh,max를 지원하며, Responses API에서 기본 도구와 함수 호출을 사용할 수 있음 - 입력 가격은 1M 토큰당 2달러, 출력 가격은 10달러이며, 캐시 입력은 0.20달러, 캐시 쓰기는 2.50달러임
- 텍스트 입력·출력과 이미지 입력을 지원하고, 스트리밍·함수 호출·구조화된 출력 및 다양한 도구를 지원함
- 모델 식별자는
gpt-6-sol이며, 사용량 등급에 따라 분당 요청 수가 500~15,000RPM, 분당 토큰 수가 500,000~40,000,000TPM으로 설정됨
모델 개요
- GPT-6 Sol은 복잡한 코딩과 에이전트 워크플로를 지원하도록 설계된 모델임
- 추론 강도(
reasoning.effort)는none,low,medium(기본값),high,xhigh,max임 - 기본 제공 도구와 함수 호출에는 Responses API 사용이 권장됨
- Chat Completions API에서는
reasoning_effort를none으로 설정한 경우에만 함수 호출이 지원됨 - 유럽연합 데이터 레지던시는 Standard 처리에서만 이용 가능함
- 컨텍스트 윈도우는 1,050,000 토큰임
- 최대 출력은 128,000 토큰임
- 지식 기준일은 2026년 4월 20일임
- 추론 토큰을 지원함
가격
- 가격은 사용한 토큰 수 또는 모델 유형에 따른 다른 지표를 기준으로 책정됨
- 검색과 컴퓨터 사용 같은 도구 전용 모델은 도구 호출당 요금이 부과됨
- 텍스트 토큰 기준 가격은 다음과 같음
- 입력: 1M 토큰당 2.00달러
- 캐시 입력: 1M 토큰당 0.20달러
- 캐시 쓰기: 1M 토큰당 2.50달러
- 출력: 1M 토큰당 10.00달러
- 캐시 입력 토큰은 캐시되지 않은 입력 가격의 10%로 책정됨
- 캐시 쓰기는 캐시되지 않은 입력 가격의 1.25배로 청구됨
- 입력 토큰이 272,000개를 초과하는 프롬프트는 전체 요청에 대해 입력·캐시 요금이 2배, 출력 요금이 1.5배로 적용됨
- 이용 가능한 경우 지역 처리에는 10%의 추가 요금이 붙음
- 유럽연합 데이터 레지던시는 Standard 처리에서만 이용 가능함
- Batch와 Flex는 Standard 요금의 50%로 책정됨
- Fast 모드는 해당 요금의 2배로 책정됨
지원 양식
- 입력 및 출력: 텍스트
- 입력: 이미지
- 오디오: 지원되지 않음
- 비디오: 지원되지 않음
엔드포인트
- Live:
v1/live/sessions - Chat Completions:
v1/chat/completions - Responses:
v1/responses - Realtime:
v1/realtime - Realtime 번역:
v1/realtime/translations - Realtime 전사:
v1/realtime/transcription_sessions - Assistants:
v1/assistants - Batch:
v1/batch - 미세 조정:
v1/fine-tuning - 임베딩:
v1/embeddings - 이미지 생성:
v1/images/generations - 동영상:
v1/videos - 이미지 편집:
v1/images/edits - 음성 생성:
v1/audio/speech - 전사:
v1/audio/transcriptions - 번역:
v1/audio/translations - 조정:
v1/moderations - 레거시 Completions:
v1/completions
기능
- 스트리밍: 지원됨
- 함수 호출: 지원됨
- 구조화된 출력: 지원됨
- 미세 조정: 지원되지 않음
지원 도구
- 다음 도구는 Responses API 사용 시 지원됨
- 웹 검색
- 파일 검색
- 이미지 생성
- 코드 인터프리터
- 호스팅 셸
- 패치 적용
- 스킬
- 컴퓨터 사용
- MCP
- 도구 검색
모델 식별자
- API 요청에는
gpt-6-sol을 사용함 - 모델 식별자:
gpt-6-sol
사용량 제한
- 사용량 제한은 일정 기간 내 요청 수, 토큰 수, 오디오 길이 또는 기타 사용량에 상한을 설정해 공정하고 안정적인 API 접근을 보장함
- 사용 등급에 따라 제한 수준이 결정되며, 요청과 지출이 늘어나면 자동으로 상향됨
- Tier 1: 500RPM, 500,000TPM, Batch 대기열 한도 1,500,000
- Tier 2: 5,000RPM, 1,000,000TPM, Batch 대기열 한도 3,000,000
- Tier 3: 5,000RPM, 2,000,000TPM, Batch 대기열 한도 100,000,000
- Tier 4: 10,000RPM, 4,000,000TPM, Batch 대기열 한도 200,000,000
- Tier 5: 15,000RPM, 40,000,000TPM, Batch 대기열 한도 15,000,000,000
- Free 등급은 지원되지 않음
댓글 (0)
로그인하면 이 기사에 내 생각을 남길 수 있어요