GPT-6 Sol API 요금: 캐시와 긴 입력 비용 계산하기
GPT-6 Sol의 입력·출력·캐시 요금을 구분하고 272K 초과 시 요청 전체에 적용되는 요금을 확인합니다. 비용 표와 로컬 계산기로 예산을 검산하세요.
OpenAI 직접 API에서 GPT-6 Sol의 Standard 단가는 입력 272K 이하일 때 일반 입력 100만 토큰당 2달러, 출력 10달러입니다. 캐시 읽기·쓰기, 입력 길이, 처리 모드에 따라 총비용이 달라지므로 이 두 항목만 곱해서는 충분하지 않습니다.
2026년 9월 23일 공식 모델 문서와 요금 문서를 확인했습니다. 아래 단위는 텍스트 100만 토큰당 미국 달러이며, Ofox 요금이나 구독 사용 한도가 아닌 OpenAI 직접 연결 가격입니다.
입력 길이에 맞는 요금 적용하기
| Standard 입력 길이 | 일반 입력 | 캐시 읽기 | 캐시 쓰기 | 출력 |
|---|---|---|---|---|
| 272K 이하 | 2 | 0.20 | 2.50 | 10 |
| 272K 초과 | 4 | 0.40 | 5 | 15 |
272K를 넘으면 요청 전체에 긴 입력 요금이 적용됩니다. 초과한 토큰만 비싸게 계산하는 방식이 아닙니다. 모델이 수용하는 최대 컨텍스트 크기와 가격이 바뀌는 기준은 별개입니다.
Batch와 Flex는 해당 Standard 요금의 절반, Fast는 두 배입니다. 서로 다른 모드를 임의로 조합해 할인을 중복 적용할 수 없습니다. 지원되는 지역 처리의 추가 요금도 확인해야 하며, 현재 EU 데이터 레지던시는 Standard만 지원합니다. 실제 요청에 사용한 모드로 계산하세요.
캐시 쓰기를 일반 입력에도 중복 계산하지 않기
캐시 문서에 맞춰 일반 입력, 캐시 읽기, 캐시 쓰기를 겹치지 않는 수량으로 나눕니다. 쓰기 요금이 적용되는 같은 토큰을 일반 입력에도 넣으면 비용을 이중으로 계산하게 됩니다.
비용 = (일반 입력 × 입력 단가 + 캐시 읽기 × 읽기 단가
+ 캐시 쓰기 × 쓰기 단가 + 과금 출력 × 출력 단가) / 1,000,000
사용량 내보내기에 총입력과 캐시 세부 항목이 있다면 먼저 필드 정의를 확인합니다. 출력도 화면에 보이는 글자 수가 아니라 적용되는 추론 토큰을 포함한 과금 대상 수량을 사용해야 합니다.
고정된 수량으로 검산하기
Standard 요청에 일반 입력 20,000, 캐시 읽기 60,000, 캐시 쓰기 20,000, 과금 출력 5,000토큰이 있다고 가정합니다. 각 수량은 겹치지 않으며 실제 모델 실행 결과가 아닌 계산 예시입니다.
| 항목 | 계산 | 달러 |
|---|---|---|
| 일반 입력 | 20,000 × 2 / 1M | 0.040 |
| 읽기 | 60,000 × 0.20 / 1M | 0.012 |
| 쓰기 | 20,000 × 2.50 / 1M | 0.050 |
| 출력 | 5,000 × 10 / 1M | 0.050 |
| 합계 | 네 항목 합산 | 0.152 |
요금·예시 CSV와 Python 계산기로 검산할 수 있습니다. 계산기는 통신하거나 청구서를 읽지 않으며 캐시 적중률을 예측하지 않습니다.
캐시 없이 일반 입력 300,000, 출력 5,000토큰이라면 요청 전체에 긴 입력 요금을 적용합니다. 0.3 × 4 + 0.005 × 15 = 1.275달러이며 적용 가능한 추가 비용은 별도입니다. 처음 272K를 낮은 단가로 계산하면 예산을 과소평가합니다.
단가 절반이 작업 비용 절반을 뜻하지는 않음
출시 발표는 이전 GPT-5.6 Sol의 프로모션 입력·출력 가격 4/20달러와 새 가격 2/10달러를 비교합니다. 이 두 단가는 50% 내려갔지만 작업의 컨텍스트, 추론, 도구 사용과 재시도 횟수는 달라질 수 있습니다.
과거 청구서는 당시 요금으로 유지합니다. 과거 사용량에 새 가격을 대입하는 것은 가정에 따른 비교이지 이미 낸 금액의 변경이 아닙니다. 이전을 판단할 때는 같은 통과 조건을 만족하는 총비용과 사람의 수정 시간을 봐야 합니다.
통과한 작업 단위로 기록하기
정확한 모델 ID, 공급자, 처리 모드, 입력 길이, 캐시 분류, 출력, 도구 비용과 통과 여부를 남깁니다. 실패한 요청도 포함해야 버린 결과에 든 비용을 놓치지 않습니다.
Sol과 Opus 5.5 비교는 같은 기준의 계산을, GPT-6 선택 가이드는 작업별 평가 출발점을 다룹니다. 게이트웨이에서는 실제 경로의 요금을 다시 확인하고 OpenAI 직접 가격을 Ofox 가격으로 대체하지 마세요.
자주 묻는 질문
- 272K를 넘는 부분만 비싸게 계산하나요?
- 아니요. 입력이 272K를 넘으면 해당 긴 입력 요금이 요청 전체에 적용됩니다.
- 캐시 쓰기에 일반 입력 요금도 더하나요?
- 같은 토큰을 중복 계산하지 않습니다. 쓰기 수량과 일반 입력 수량을 구분해야 합니다.
- 단가가 절반이면 작업 비용도 절반인가요?
- 반드시 그렇지는 않습니다. 사용량, 도구, 재시도와 결과의 통과 여부에 따라 달라집니다.


