TL;DR
GPT-5.6은 모델(3종), 추론 노력(6단계), 속도(2단계)를 조합해 총 36개 구성 옵션을 제공하며 이 조합이 각 설정의 비용과 출력 처리량을 결정한다. 이미지에 따르면 Sol은 1M 토큰당 입력 $5·출력 $30로 출력 처리량 약 60–73 tok/s에 머무르고 Terra와 Luna는 각각 더 낮은 단가에 더 높은 출력 토큰 처리량(약 120–140 tok/s, 190–204 tok/s)을 보인다. 속도 모드는 Standard와 Fast로 나뉘며 Fast는 관찰된 사용량을 약 1.5배 증가시키는 것으로 표기되어 있어 속도 선택이 비용 트레이드오프에 직접적인 영향을 준다. 결과적으로 API 사용자는 단일 슬라이더 기반의 단순한 선택 대신 모델 등급·추론 노력·속도 간 상호작용을 고려해 비용과 성능을 균형 있게 설계해야 한다.
섹션별 상세
이미지 분석

이미지는 모델 축에 Sol/Terra/Luna를, 가로 축에 추론 노력 단계(Light에서 Ultra), 깊이 축에 속도(Standard/Fast)를 배치해 3×6×2 구조로 총 36개 조합을 시각화하고 있다. 각 모델 카드에는 1M 토큰당 입력/출력 가격과 관찰된 출력 토큰 처리량 범위(예: Sol 약 60–73 tok/s, Terra 약 120–140 tok/s, Luna 약 190–204 tok/s)가 수치로 표시되어 있어 비용과 처리량 관계를 직접 비교할 수 있다. 다이어그램의 주석은 Fast 모드가 Standard보다 약 1.5배 더 많은 사용량을 유발한다고 명시해 속도 설정이 비용에 미치는 영향을 강조하고 있다.
GPT-5.6의 모델·추론 노력·속도 세 축을 조합한 3차원 구성 큐브와 각 모델별 가격 및 출력 처리량 범위를 표기한 다이어그램이다.
용어 해설
- Throughput
- — API 호출에서 단위 시간당 생성되는 출력 토큰 수를 뜻하며, 모델 종류·속도·추론 노력 설정에 따라 실제 처리량이 달라져 비용과 응답 지연에 직결된다.
- Reasoning Effort
- — 모델이 문제 해결을 위해 내부적으로 더 많은 계산이나 반복적 사고를 수행하도록 설정하는 축으로, 라이트부터 울트라까지 단계별로 처리 지연과 토큰 출력률이 변화한다.
- Token Pricing
- — 입력 토큰과 출력 토큰에 대해 별도 단가를 부과하는 과금 방식으로, 모델과 속도 설정에 따라 1M 토큰당 요금이 달라지며 비용 산정에 직접적인 영향을 준다.
- Speed Mode
- — 표준(Standard)과 고속(Fast) 두 가지로 제공되는 실행 모드로, 고속 모드는 처리량과 비용에 영향을 주며 이미지에선 대략 1.5배 더 많은 사용량을 발생시키는 것으로 표기되어 있다.
근거 모음
- GPT-5.6의 총 구성 수는 모델 3종·추론 노력 6단계·속도 2단계를 곱한 36가지이다. — 이미지 상단 타이틀과 부제에 'MODEL × REASONING EFFORT × SPEED = 3 × 6 × 2 = 36 configurations' 표기
- GPT-5.6 Sol의 가격은 1M 토큰당 입력 $5·출력 $30이며 출력 처리량은 약 60–73 output tok/s이다. — 이미지 내 왼쪽 상단 모델 카드에 표시된 Sol의 가격·처리량 라인
- GPT-5.6 Luna의 가격은 1M 토큰당 입력 $1·출력 $6이며 출력 처리량은 약 190–204 output tok/s이다. — 이미지 내 오른쪽 상단 모델 카드에 표시된 Luna의 가격·처리량 라인
AI 요약 · 북마크 · 개인 피드 설정 — 무료
출처 · 인용 안내
인용 시 "요약 출처: AI Trends (aitrends.kr)"를 표기하고, 사실 확인은 원문 보기 기준으로 진행해 주세요. 자세한 기준은 운영 정책을 참고해 주세요.
