TL;DR

  • GPT-6.1 Sol은 복잡한 코딩, 컴퓨터 사용, 전문 업무에서 Astra에 근접한 성능을 더 낮은 비용으로 제공하는 모델임.
  • 추론 노력 수준은 low, medium(기본값), high, xhigh, max이며, none과 minimal은 지원하지 않음.
  • 컨텍스트 창은 1,050,000 토큰, 최대 출력은 128,000 토큰이며, 지식 기준일은 2026년 4월 30일임.
  • 입력 가격은 100만 토큰당 2달러, 출력 가격은 100만 토큰당 10달러이며, 캐시 입력은 0.10달러, 캐시 쓰기는 2.50달러임.
  • Responses API에서 도구 호출을 지원하며, 미국·유럽 데이터 레지던시를 지원하지만 유럽 데이터 레지던시에서는 Fast 모드를 사용할 수 없음.

모델 개요

  • 복잡한 코딩, 컴퓨터 사용, 전문 업무에서 Astra에 근접한 성능을 더 낮은 비용으로 제공함.
  • 작업별 품질과 비용의 절충을 판단할 수 있도록 Astra와 직접 비교할 것을 권장함.
  • 추론 수준은 Highest, 속도는 Fast, 가격 등급은 $2 입력·$10 출력임.
  • 입력은 텍스트와 이미지, 출력은 텍스트를 지원함.
  • reasoning.effort는 low, medium(기본값), high, xhigh, max를 지원하며, none과 minimal은 지원하지 않음.
  • 컨텍스트 창은 1,050,000 토큰, 최대 출력 토큰은 128,000개임.
  • 지식 기준일은 2026년 4월 30일임.
  • 추론 토큰 지원 모델임.

API 및 데이터 레지던시

  • 도구 호출에는 Responses API를 사용함.
  • 도구 호출 기능이 없는 Chat Completions도 지원함.
  • 미국과 유럽 데이터 레지던시를 지원함.
  • 유럽 데이터 레지던시에서는 Fast 모드를 사용할 수 없음.
  • 데이터 레지던시 자격 요건은 데이터 레지던시 안내에서 확인할 수 있음.
  • 자세한 내용은 GPT-6.1 Sol 안내와 모델 선택 지침에서 확인할 수 있음.

가격

  • 가격은 사용한 토큰 수 또는 모델 유형에 따른 다른 사용량 지표를 기준으로 산정됨.
  • 검색 및 컴퓨터 사용과 같은 도구 전용 모델은 도구 호출당 요금이 부과됨.
  • 텍스트 토큰 가격은 다음과 같음.
  • 입력: 100만 토큰당 2.00달러
  • 캐시 입력: 100만 토큰당 0.10달러
  • 캐시 쓰기: 100만 토큰당 2.50달러
  • 출력: 100만 토큰당 10.00달러
  • 캐시 입력 토큰은 캐시되지 않은 입력 토큰 가격의 5%로 책정됨.
  • 캐시 쓰기는 캐시되지 않은 입력 토큰 가격의 1.25배로 청구됨.
  • 입력 토큰이 272,000개를 초과하는 프롬프트는 전체 요청에 입력 및 캐시 요금 2배, 출력 요금 1.5배가 적용됨.
  • Fast 모드 가격은 Standard의 2배임.
  • Batch 및 Flex 가격은 Standard보다 50% 낮음.
  • 지역 처리는 제공되는 경우 10%의 추가 요금이 발생함.

모달리티 및 엔드포인트

  • 모달리티 지원 범위는 다음과 같음.
  • 텍스트: 입력 및 출력
  • 이미지: 입력만
  • 오디오: 지원하지 않음
  • 비디오: 지원하지 않음
  • 지원 엔드포인트는 다음과 같음.
  • Live: v1/live/sessions
  • Chat Completions: v1/chat/completions
  • Responses: v1/responses
  • Realtime: v1/realtime
  • Realtime 번역: v1/realtime/translations
  • Realtime 전사: v1/realtime/transcription_sessions
  • Assistants: v1/assistants
  • Batch: v1/batch
  • 파인튜닝: v1/fine-tuning
  • 임베딩: v1/embeddings
  • 이미지 생성: v1/images/generations
  • 비디오: v1/videos
  • 이미지 편집: v1/images/edits
  • 음성 생성: v1/audio/speech
  • 전사: v1/audio/transcriptions
  • 번역: v1/audio/translations
  • 모더레이션: v1/moderations
  • 레거시 Completions: v1/completions

기능 및 도구

  • 기능 지원 범위는 다음과 같음.
  • 스트리밍: 지원
  • 함수 호출: 지원
  • 구조화된 출력: 지원
  • 파인튜닝: 지원하지 않음
  • Responses API 사용 시 지원 도구는 다음과 같음.
  • 웹 검색
  • 파일 검색
  • 이미지 생성
  • 코드 인터프리터
  • 호스티드 셸
  • 패치 적용
  • 스킬
  • 컴퓨터 사용
  • MCP
  • 도구 검색

스냅샷

  • 이 모델을 선택할 때 gpt-6.1-sol을 사용함.
  • 스냅샷 식별자는 gpt-6.1-sol임.

사용량 제한

  • 사용량 제한은 일정 기간 동안 요청, 토큰, 오디오 길이 또는 기타 사용량에 상한을 두어 API 접근의 공정성과 신뢰성을 보장함.
  • 제한 수준은 사용 티어에 따라 달라지며, 요청 수와 API 지출이 증가하면 자동으로 높아짐.
  • 티어별 분당 요청 수(RPM) 및 분당 토큰 수(TPM)는 다음과 같음.
  • Free: 지원하지 않음
  • Tier 1: 500 RPM, 500,000 TPM
  • Tier 2: 5,000 RPM, 1,000,000 TPM
  • Tier 3: 5,000 RPM, 2,000,000 TPM
  • Tier 4: 10,000 RPM, 4,000,000 TPM
  • Tier 5: 15,000 RPM, 40,000,000 TPM