GPT-5.6 세 모델의 단가를 먼저 나눕니다
공식 모델 비교 페이지의 2026년 8월 28일 표시값입니다. 미국 달러, 100만 토큰 기준이며 추론에 사용된 토큰도 출력 토큰으로 청구될 수 있습니다.

| 모델 | 입력 | 캐시 입력 | 출력 |
|---|---|---|---|
| GPT-5.6 Sol | $4.00 | $0.40 | $20.00 |
| GPT-5.6 Terra | $2.00 | $0.20 | $12.00 |
| GPT-5.6 Luna | $0.20 | $0.02 | $1.20 |
Sol은 복잡한 전문 작업, Terra는 지능과 비용의 균형, Luna는 비용 민감 작업을 목표로 소개됩니다. 세 모델 모두 105만 토큰 컨텍스트와 최대 12만8천 출력 토큰을 지원하지만, 컨텍스트 한도를 채울 수 있다는 사실과 그렇게 쓰는 것이 경제적이라는 판단은 다릅니다.
ChatGPT 구독과 API 크레딧은 별도입니다
ChatGPT Plus·Pro 같은 월 구독은 ChatGPT 앱 사용 권한입니다. API 플랫폼에서 발생한 토큰 비용을 대신 내주지 않습니다. API 키를 발급하고 결제 수단이나 크레딧을 설정하면 별도 사용량이 쌓입니다.
모델 페이지의 rate limit 표에 Free가 ‘-’로 표시된 모델은 무료 호출 한도가 없다는 뜻입니다. ChatGPT에서 같은 이름의 모델을 사용할 수 있다고 API도 무료인 것은 아닙니다. 결제 전 프로젝트별 사용 한도와 알림을 설정하세요.
월 비용은 세 항목을 더합니다
(일반 입력 토큰 ÷ 1,000,000 × 입력 단가) + (캐시 입력 토큰 ÷ 1,000,000 × 캐시 단가) + (출력 토큰 ÷ 1,000,000 × 출력 단가)
한 달에 일반 입력 2천만 토큰, 캐시 입력 3천만 토큰, 출력 5백만 토큰을 쓴다고 가정해봅니다.
| 모델 | 입력 | 캐시 | 출력 | 합계 |
|---|---|---|---|---|
| Sol | $80 | $12 | $100 | $192 |
| Terra | $40 | $6 | $60 | $106 |
| Luna | $4 | $0.60 | $6 | $10.60 |
이 사례에서는 출력이 전체 토큰의 9% 남짓이지만 Sol 비용의 절반 이상을 차지합니다. 긴 답변을 매번 저장하지 않거나 필요한 JSON 필드만 받는 설계가 모델을 한 단계 낮추는 것만큼 큰 절감이 될 수 있습니다.
캐시 단가는 모든 반복 문장에 자동 적용되지 않습니다
캐시 입력 가격은 이전 요청과 공통된 프롬프트 접두부가 캐시 요건을 충족할 때 적용됩니다. 같은 시스템 지침, 도구 정의, 긴 참고 문서를 요청 앞부분에 안정적으로 배치하면 유리합니다. 매 요청마다 날짜나 사용자 ID가 앞부분에서 바뀌면 공통 접두부가 짧아져 기대한 절감이 나오지 않을 수 있습니다.
비용표를 만들 때 입력 전체를 캐시 단가로 계산하면 과소예산이 됩니다. 실제 응답의 usage 필드에서 일반 입력과 캐시 입력을 분리해 일주일 정도 측정한 뒤 비율을 예산에 반영하세요.
Batch는 실시간이 필요 없는 작업에만 맞습니다
공식 가격 문서는 Batch API가 입력과 출력 비용을 50% 절감하며 비동기 작업을 24시간 안에 처리한다고 안내합니다. 밤새 문서 분류, 평가 데이터 생성처럼 바로 답을 보여줄 필요가 없는 작업에 적합합니다. 사용자가 기다리는 채팅 응답을 Batch로 바꾸면 비용은 줄어도 제품 경험이 나빠집니다.
처음부터 한 모델로 전부 처리하지 않습니다
분류·형식 변환은 Luna로 먼저 검증하고, 실패율이 높은 요청만 Terra나 Sol로 올리는 흐름이 현실적입니다. 모델별로 같은 샘플 50~100건을 실행해 정확도, 재시도율, 평균 출력 토큰을 함께 기록하세요. 싼 모델이 재시도를 두 배 만든다면 가격표의 단가만큼 싸지 않을 수 있습니다.
운영에서는 프로젝트별 월 예산, 일별 알림, 요청당 최대 출력 토큰을 둡니다. 비용 급증은 공격적인 사용량뿐 아니라 무한 재시도와 지나치게 긴 도구 결과에서도 생깁니다.
OpenAI 공식 모델 비교·API 가격 문서를 2026년 8월 28일 확인했습니다.