TL;DR
- GPT-6.1 Sol은 복잡한 코딩, 컴퓨터 사용, 전문 업무에서 Astra에 근접한 성능을 더 낮은 비용으로 제공하는 모델임.
- 추론 노력 수준은 low, medium(기본값), high, xhigh, max이며, none과 minimal은 지원하지 않음.
- 컨텍스트 창은 1,050,000 토큰, 최대 출력은 128,000 토큰이며, 지식 기준일은 2026년 4월 30일임.
- 입력 가격은 100만 토큰당 2달러, 출력 가격은 100만 토큰당 10달러이며, 캐시 입력은 0.10달러, 캐시 쓰기는 2.50달러임.
- Responses API에서 도구 호출을 지원하며, 미국·유럽 데이터 레지던시를 지원하지만 유럽 데이터 레지던시에서는 Fast 모드를 사용할 수 없음.
모델 개요
- 복잡한 코딩, 컴퓨터 사용, 전문 업무에서 Astra에 근접한 성능을 더 낮은 비용으로 제공함.
- 작업별 품질과 비용의 절충을 판단할 수 있도록 Astra와 직접 비교할 것을 권장함.
- 추론 수준은 Highest, 속도는 Fast, 가격 등급은 $2 입력·$10 출력임.
- 입력은 텍스트와 이미지, 출력은 텍스트를 지원함.
reasoning.effort는 low, medium(기본값), high, xhigh, max를 지원하며, none과 minimal은 지원하지 않음.- 컨텍스트 창은 1,050,000 토큰, 최대 출력 토큰은 128,000개임.
- 지식 기준일은 2026년 4월 30일임.
- 추론 토큰 지원 모델임.
API 및 데이터 레지던시
- 도구 호출에는 Responses API를 사용함.
- 도구 호출 기능이 없는 Chat Completions도 지원함.
- 미국과 유럽 데이터 레지던시를 지원함.
- 유럽 데이터 레지던시에서는 Fast 모드를 사용할 수 없음.
- 데이터 레지던시 자격 요건은 데이터 레지던시 안내에서 확인할 수 있음.
- 자세한 내용은 GPT-6.1 Sol 안내와 모델 선택 지침에서 확인할 수 있음.
가격
- 가격은 사용한 토큰 수 또는 모델 유형에 따른 다른 사용량 지표를 기준으로 산정됨.
- 검색 및 컴퓨터 사용과 같은 도구 전용 모델은 도구 호출당 요금이 부과됨.
- 텍스트 토큰 가격은 다음과 같음.
- 입력: 100만 토큰당 2.00달러
- 캐시 입력: 100만 토큰당 0.10달러
- 캐시 쓰기: 100만 토큰당 2.50달러
- 출력: 100만 토큰당 10.00달러
- 캐시 입력 토큰은 캐시되지 않은 입력 토큰 가격의 5%로 책정됨.
- 캐시 쓰기는 캐시되지 않은 입력 토큰 가격의 1.25배로 청구됨.
- 입력 토큰이 272,000개를 초과하는 프롬프트는 전체 요청에 입력 및 캐시 요금 2배, 출력 요금 1.5배가 적용됨.
- Fast 모드 가격은 Standard의 2배임.
- Batch 및 Flex 가격은 Standard보다 50% 낮음.
- 지역 처리는 제공되는 경우 10%의 추가 요금이 발생함.
모달리티 및 엔드포인트
- 모달리티 지원 범위는 다음과 같음.
- 텍스트: 입력 및 출력
- 이미지: 입력만
- 오디오: 지원하지 않음
- 비디오: 지원하지 않음
- 지원 엔드포인트는 다음과 같음.
- Live:
v1/live/sessions - Chat Completions:
v1/chat/completions - Responses:
v1/responses - Realtime:
v1/realtime - Realtime 번역:
v1/realtime/translations - Realtime 전사:
v1/realtime/transcription_sessions - Assistants:
v1/assistants - Batch:
v1/batch - 파인튜닝:
v1/fine-tuning - 임베딩:
v1/embeddings - 이미지 생성:
v1/images/generations - 비디오:
v1/videos - 이미지 편집:
v1/images/edits - 음성 생성:
v1/audio/speech - 전사:
v1/audio/transcriptions - 번역:
v1/audio/translations - 모더레이션:
v1/moderations - 레거시 Completions:
v1/completions
기능 및 도구
- 기능 지원 범위는 다음과 같음.
- 스트리밍: 지원
- 함수 호출: 지원
- 구조화된 출력: 지원
- 파인튜닝: 지원하지 않음
- Responses API 사용 시 지원 도구는 다음과 같음.
- 웹 검색
- 파일 검색
- 이미지 생성
- 코드 인터프리터
- 호스티드 셸
- 패치 적용
- 스킬
- 컴퓨터 사용
- MCP
- 도구 검색
스냅샷
- 이 모델을 선택할 때
gpt-6.1-sol을 사용함. - 스냅샷 식별자는
gpt-6.1-sol임.
사용량 제한
- 사용량 제한은 일정 기간 동안 요청, 토큰, 오디오 길이 또는 기타 사용량에 상한을 두어 API 접근의 공정성과 신뢰성을 보장함.
- 제한 수준은 사용 티어에 따라 달라지며, 요청 수와 API 지출이 증가하면 자동으로 높아짐.
- 티어별 분당 요청 수(RPM) 및 분당 토큰 수(TPM)는 다음과 같음.
- Free: 지원하지 않음
- Tier 1: 500 RPM, 500,000 TPM
- Tier 2: 5,000 RPM, 1,000,000 TPM
- Tier 3: 5,000 RPM, 2,000,000 TPM
- Tier 4: 10,000 RPM, 4,000,000 TPM
- Tier 5: 15,000 RPM, 40,000,000 TPM
댓글 (0)
로그인하면 이 기사에 내 생각을 남길 수 있어요