OpenAI, GPT-5.6 Sol API 가격 인하…입력 20%·출력 33%
Date: 2026-08-23 Topic: AI API 가격 Primary source: OpenAI Developers
OpenAI가 8월 21일 GPT-5.6 Sol의 API 프로모션 가격을 적용했다. 일반 컨텍스트 기준 100만 토큰당 입력 가격은 5달러에서 4달러로 20%, 출력 가격은 30달러에서 20달러로 약 33% 내려갔다. 할인은 최소 2026년 11월 21일까지 이어질 예정이다.
이번 조정은 GPT-5.6 계열의 최상위 모델을 API로 쓰는 개발자와 기업에 직접 영향을 준다. 같은 양의 입력과 출력을 처리해도 비용 감소 폭이 서로 다르기 때문에, 실제 절감액은 서비스가 긴 문서를 읽는지, 긴 답변을 생성하는지에 따라 달라진다. 특히 출력 비중이 큰 코딩·리서치 에이전트가 상대적으로 더 큰 혜택을 볼 수 있다.
News Brief
OpenAI 공식 모델 문서에 표시된 GPT-5.6 Sol의 프로모션 가격은 다음과 같다.
- 입력: 100만 토큰당 4달러
- 캐시된 입력: 100만 토큰당 0.40달러
- 출력: 100만 토큰당 20달러
- 적용 기간: 최소 2026년 11월 21일까지
GPT-5.6 Sol은 GPT-5.6 제품군에서 복잡한 전문 업무를 겨냥한 최상위 모델이다. gpt-5.6 별칭도 이 모델로 연결된다. 이번 가격은 모델 성능이나 식별자를 바꾼 것이 아니라, API에서 처리한 토큰에 매기는 단가를 한시적으로 낮춘 조치다.
Key Details
가격 인하는 입력과 출력에 똑같이 적용되지 않는다. 이전 일반 단가는 입력 5달러, 출력 30달러였고, 프로모션 단가는 각각 4달러와 20달러다.
| 구분 | 이전 가격 | 프로모션 가격 | 인하 폭 |
|---|---|---|---|
| 입력 100만 토큰 | $5 | $4 | 20% |
| 출력 100만 토큰 | $30 | $20 | 약 33% |
| 입력 100만 + 출력 100만 | $35 | $24 | 약 31% |
예를 들어 한 달 동안 입력 100만 토큰과 출력 100만 토큰을 사용했다면 토큰 비용은 35달러에서 24달러로 11달러 줄어든다. 반면 입력이 대부분이고 출력은 짧은 검색·분류 서비스라면 절감률은 20%에 가까워진다. 긴 코드나 보고서를 생성하는 서비스처럼 출력 토큰 비중이 높을수록 전체 절감률은 더 커진다.
가격 계산에는 예외도 있다. 입력이 27만2천 토큰을 넘는 요청은 요청 전체에 대해 입력 단가가 2배, 출력 단가가 1.5배 적용된다. 또한 프롬프트 캐시를 새로 기록할 때는 일반 입력 단가의 1.25배가 청구된다. 따라서 긴 문맥을 한 번에 넣는 에이전트는 기본 가격만 곱해서 예산을 잡으면 실제 청구액과 차이가 날 수 있다.
Background
생성형 AI 서비스 비용은 단순히 사용자가 보낸 글자 수로 결정되지 않는다. 모델이 읽은 입력 토큰, 새로 만든 출력 토큰, 재사용한 캐시, 긴 컨텍스트 할증, 도구 호출 비용이 합쳐진다. 같은 모델을 사용해도 제품 구조에 따라 청구액이 크게 달라지는 이유다.
GPT-5.6 Sol은 105만 토큰의 컨텍스트 창과 최대 12만8천 출력 토큰을 지원한다. 긴 저장소나 여러 문서를 한꺼번에 다루기에는 유리하지만, 실제 운영에서는 한 요청에 문맥을 얼마나 넣을지와 기존 입력을 얼마나 캐시로 재사용할지가 비용을 좌우한다. 가격 인하가 비용 설계를 대신해 주는 것은 아니다.
Core Lens
이번 변화의 핵심은 최상위 모델이 단순히 싸졌다는 사실보다, 출력이 많은 에이전트형 서비스의 비용 구조가 한시적으로 유리해졌다는 데 있다.
What It Means
개발팀에는 기존 워크로드를 다시 측정해 볼 계기가 생겼다. 저렴한 모델로 나눠 처리하던 일부 복잡한 작업을 Sol에 맡겨 성공률이 높아진다면, 호출당 가격이 비싸더라도 전체 재시도 횟수와 후처리 비용은 줄어들 수 있다. 반대로 분류·요약처럼 요구 수준이 명확한 대량 작업은 더 저렴한 모델을 유지하는 편이 합리적일 수 있다.
중요한 점은 토큰 단가와 업무 완료 비용을 구분하는 것이다. 모델이 한 번에 작업을 끝내는 비율, 평균 출력 길이, 실패 후 재호출 횟수까지 함께 봐야 실제 경제성을 판단할 수 있다. 이번 프로모션 기간은 운영 데이터를 모아 모델별 비용과 품질을 비교하기에 적절한 시험 구간이 될 수 있다.
What To Watch
- 프로모션 가격이 11월 21일 이후에도 유지되거나 다른 형태로 조정되는지
- OpenAI 공식 가격표와 실제 청구 내역이 서비스 계층별로 어떻게 구분되는지
- 출력 비용 감소가 코딩·리서치 에이전트의 모델 선택을 바꾸는지
- 27만2천 토큰을 넘는 장기 컨텍스트 요청과 캐시 전략이 총비용에 미치는 영향
가격은 바뀔 수 있으므로 도입 결정을 내릴 때는 고정된 블로그 글보다 OpenAI의 최신 모델 문서와 가격표를 다시 확인하는 편이 안전하다.