본문으로 건너뛰기
블로그로 돌아가기
[REVIEW]

2026년 7~8월 OpenAI 가격 인하, Claude·Gemini 비교로 확인할 4가지

퀀텀점프클럽 정상록퀀텀점프클럽 정상록15분 읽기3 views

무료 자료

PDF · 무료

AI 요금 인하, 진짜 아끼는 법은 따로 있어요 — 비개발자를 위한 쉬운 가이드

긴 글을 다 읽기 전에, 실무 가이드부터 먼저 챙겨가세요.

2026년 8월 OpenAI 가격 인하, Claude·Gemini와 비교해 반드시 확인할 4가지

OpenAI는 2026년 7월 말과 8월에 걸쳐 두 번 가격을 내렸는데, 프론티어 모델 Sol 인하는 11월 21일까지인 한시 프로모션입니다. 실제 요금표와 Claude·Gemini 비교를 정리했습니다.

결론부터 말씀드리면, OpenAI 가격 인하는 실제로 일어났습니다. 다만 "얼마나 싸졌나"를 확인하려던 분들이 가장 먼저 마주치는 질문은 이거였을 겁니다. "이거 진짜 계속 이 가격인가요, 아니면 반짝 이벤트인가요?" 당연한 의심입니다. 프론티어 모델 가격을 할인하면서 아무 조건도 안 다는 회사는 드물거든요. 이 글은 그 질문에서 출발합니다. OpenAI API 요금이 실제로 어떻게 바뀌었는지, Claude·Gemini와 비교하면 지금 누가 싼지, 그리고 요금표만 봐서는 놓치는 숨은 비용까지 순서대로 짚어보겠습니다.

목차

실제로 무엇이 내렸나: 7월 말과 8월, 두 번의 OpenAI 가격 인하

한 달 사이 인하가 한 번이 아니라 두 번 있었습니다. 성격이 완전히 다른 두 이벤트라 구분해서 봐야 오해가 없습니다.

2026-07-30: Luna·Terra, 기한 없는 정가 인하

모델인하 전 (입력/출력)인하 후 (입력/출력)인하율
GPT-5.6 Luna$1.00 / $6.00$0.20 / $1.20입력·출력 각 80.0%
GPT-5.6 Terra$2.50 / $15.00$2.00 / $12.00입력·출력 각 20.0%

(단위: per 1M tokens, 즉 100만 토큰당 USD)

OpenAI는 GPT-5.6 개발 과정에서 얻은 효율 개선(speculative decoding 등)을 근거로 들었습니다. 이 인하에는 종료일이 없습니다.

2026-08-21: Sol, 한시 프로모션 인하

항목인하 전인하 후인하율
입력$5.00$4.0020.0%
출력$30.00$20.0033.3%
캐시 입력$0.50$0.4020.0%

여기서 짚어야 할 게 있습니다. OpenAI 발표 문구는 "over 20%"였지만, 실제로는 입력 20.0%·출력 33.3% 인하입니다. 출력 토큰이 비용의 대부분을 차지하는 코딩·에이전트 워크로드라면 체감 절감폭은 발표 문구보다 큽니다.

그리고 가장 중요한 조건 하나. OpenAI 공식 요금표에는 "GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026"라고 명시돼 있습니다. 최소 그때까지만 보장이라는 뜻이죠. 적용 범위도 종량제 API·Codex 크레딧·일부 ChatGPT Work 플랜에 한정되고, Pro·Plus·Business 구독 요금은 그대로입니다. 프로모션 종료 후 원래 가격($5/$30)으로 복귀할지는 공식 언급이 없어 확인이 안 됩니다.

이번 조사의 발단이 된 GuruFocus 기사(2026-08-22)의 핵심 주장 자체는 사실입니다. 다만 "한시 프로모션"이라는 조건과 "두 번의 별개 인하"라는 구조를 빼놓아서, 그 기사만 보면 영구 인하로 오해하기 쉽습니다.

한편 Anthropic은 반대 방향으로 움직였습니다. Claude Sonnet 5의 도입가 $2/$10을 2026-08-31 종료 후 $3/$15로 올릴 계획이었는데, 이 인상 계획이 철회되고 $2/$10이 그대로 표준가가 됐습니다. 8월 중순까지 나온 여러 기사가 "9월 1일 인상" 정보를 그대로 옮기고 있으니 참고하실 때 주의가 필요해요.

OpenAI vs Claude 요금 비교와 Gemini까지, 3사 요금표

"이거 우리 회사에도 되나요?"보다 먼저 나오는 질문은 "그래서 지금 뭐가 제일 싼가요?"일 겁니다. 2026-08-23 기준, 3사 공식 요금 페이지에서 확인한 표준(non-batch) 단가입니다. 모든 수치는 per 1M tokens(100만 토큰당) USD 기준입니다.

프론티어 티어

모델입력캐시 입력출력비고
Claude Fable 5$10.00$1.00$50.00현재 최고가
Claude Mythos 5$10.00$1.00$50.00제한 공급
GPT-5.6 Sol$4.00$0.40$20.00프로모션가, 2026-11-21까지 보장
Claude Opus 5$5.00$0.50$25.00표준가
Gemini 3.1 Pro (≤200K)$2.00$0.20$12.00Preview

중급 티어

모델입력캐시 입력출력
Claude Sonnet 5$2.00$0.20$10.00
GPT-5.6 Terra$2.00$0.20$12.00
Gemini 3.1 Pro (≤200K)$2.00$0.20$12.00
Claude Sonnet 4.6$3.00$0.30$15.00
Gemini 3.5 Flash$1.50$0.15$9.00

경량 티어

모델입력캐시 입력출력
Claude Haiku 4.5$1.00$0.10$5.00
Gemini 3.7 Flash$0.75$0.075$3.75
Gemini 3.5 Flash-Lite$0.30$0.03$2.50
Gemini 3.1 Flash-Lite$0.25$0.025$1.50
GPT-5.6 Luna$0.20$0.02$1.20

경량 티어는 7월 인하를 거친 Luna가 지금 가장 쌉니다.

GPT-5.6 Sol 프로모션가란?: OpenAI가 2026-08-21부터 적용한 GPT-5.6 Sol의 한시 할인 단가(입력 $4.00 / 출력 $20.00 per 1M tokens)입니다. 종량제 API와 Codex 크레딧에 적용되고, 최소 2026년 11월 21일까지 보장되며 그 이후 원래 가격($5/$30) 복귀 여부는 공식적으로 확인되지 않았습니다.

숫자로만 보면 감이 잘 안 오니, 월 입력 20M·출력 5M 토큰을 쓰는 실무 시나리오로 환산해볼게요.

모델월 비용
Claude Fable 5$450.00
GPT-5.6 Sol (인하 전)$250.00
Claude Opus 5$225.00
GPT-5.6 Sol (현재 프로모션)$180.00
Gemini 3.1 Pro / GPT-5.6 Terra$100.00
Claude Sonnet 5$90.00
Claude Haiku 4.5$45.00
Gemini 3.7 Flash$33.75
Gemini 3.1 Flash-Lite$12.50
GPT-5.6 Luna$10.00

Sol 인하 효과는 월 $250.00에서 $180.00으로, $70.00(28.0%) 절감입니다. 같은 프론티어급인 Opus 5($225.00)와 비교하면 Sol이 20.0% 쌉니다. 단, 이건 지금 이 순간의 얘기입니다. 이 숫자가 왜 그대로 믿기 어려운지는 다음 섹션에서 설명드릴게요.

요금표만 보면 오판하는 이유: 숨은 비용 3가지

여기서 많은 분이 놓치는 지점이 있습니다. 표에 적힌 단가는 "같은 조건"이라는 전제가 있을 때만 정확합니다. 실무에서는 그 전제가 자주 깨집니다.

① Claude 토크나이저가 토큰 수를 늘립니다. Claude 4.7 이후 모델과 Mythos Preview는 새 토크나이저를 씁니다. 공식 문서에 명시된 바로는 같은 텍스트라도 약 30% 더 많은 토큰으로 계산됩니다. 앞 시나리오의 Opus 5 명목 비용 $225.00은 동일 원문 기준 실효 약 $292.50이 되고, Sol($180.00)과의 격차는 20%에서 약 62%로 벌어집니다. Sonnet 4.6 이하 모델은 이전 토크나이저라 이 가산이 없다는 점도 기억해두세요.

② OpenAI 롱컨텍스트는 임계값을 넘으면 단가가 뜁니다. Sol 기준 272K 입력 토큰을 넘으면 입력은 2배($8.00), 출력은 1.5배($30.00)로 뛰어요. 앞의 시나리오 워크로드가 이 구간으로 넘어가면 월 $180.00이 $310.00으로, 72% 늘어납니다. Gemini 3.1 Pro도 200K를 넘으면 $4.00/$18.00으로 오릅니다.

③ Gemini는 캐시 저장료가 따로 붙습니다. 3사 모두 캐시 히트 시 약 90% 할인은 동일하지만, Gemini는 캐시를 시간당 별도 요금으로 보관합니다. 오래 들고 있을수록 재조회보다 비쌀 수 있다는 뜻이죠.

여기에 데이터 레지던시 할증도 있습니다. OpenAI(2026-03-05 이후 출시 모델)와 Anthropic(Sonnet 4.5·Haiku 4.5·Opus 4.5 이후 리전 엔드포인트) 모두 리전을 지정하면 10% 할증이 붙고, Gemini도 비글로벌 리전을 쓰면 10% 할증(3.7 Flash 기준 $0.75에서 $0.825)입니다.

Claude 요금 비교부터 캐싱까지, AI 모델 비용 절감 레버 4가지

모델을 고르는 것보다 어떻게 쓰는지가 비용에 더 크게 작용합니다. 공식 문서에 명시된 수치 기준으로 레버 4개를 정리했습니다.

레버 1. 프롬프트 캐싱: 3사 모두 약 90% 할인

제공사표준 입력캐시 히트캐시 쓰기
OpenAI Sol$4.00$0.40$5.00 (표준의 1.25배)
Claude Opus 5$5.00$0.505분 $6.25(1.25배) / 1시간 $10.00(2배)
Gemini 3.1 Pro$2.00$0.20별도 + 저장료 시간당 과금

주의할 점은, 캐시는 쓰는 시점에 표준 단가보다 비싸다는 겁니다. 재사용 횟수가 적으면 오히려 손해로 돌아옵니다.

레버 2. Batch API: 3사 모두 50% 할인

모델표준배치
GPT-5.6 Sol$4.00 / $20.00$2.00 / $10.00
GPT-5.6 Terra$2.00 / $12.00$1.00 / $6.00
GPT-5.6 Luna$0.20 / $1.20$0.10 / $0.60
Claude Opus 5$5.00 / $25.00$2.50 / $12.50
Claude Sonnet 5$2.00 / $10.00$1.00 / $5.00
Gemini 3.1 Pro$2.00 / $12.00$1.00 / $6.00

앞의 시나리오(월 입력 20M·출력 5M)에 Sol 배치를 적용하면 월 $180.00이 $90.00으로 떨어집니다. 실시간 응답이 필요 없는 작업(요약·분류·임베딩 전처리·평가)을 배치로 옮기는 것이 단일 레버 중 효과가 가장 큽니다.

레버 3. 컨텍스트 길이 관리

앞서 본 대로 Sol은 272K, Gemini 3.1 Pro는 200K가 임계선입니다. 이 아래로만 유지해도 롱컨텍스트 할증(최대 72%)을 피하는 것 자체가 실질 절감 효과입니다.

레버 4. 서비스 티어 라우팅 (OpenAI 기준)

서비스 티어Sol 입력/출력표준 대비
Batch / Flex$2.00 / $10.0050%
Standard$4.00 / $20.00기준
Fast mode$8.00 / $40.002배

긴급하지 않은 요청을 Flex 티어로 내리는 것만으로 표준 대비 절반까지 낮아집니다.

한 가지 주의사항도 덧붙일게요. 2026-08-23 OpenRouter 라이브 API를 확인해보니 openai/gpt-5.6-sol 라우트가 $2.00/$10.00, google/gemini-3.7-flash가 $0.375/$1.875로 공식가의 정확히 절반이었습니다. HN 댓글에는 이 Sol 라우트 할인이 2026-09-03까지라는 언급이 있었지만 OpenRouter 공식 페이지 원문으로는 확인하지 못했습니다. 프로모션 위에 얹힌 프로모션이라 가장 먼저 사라질 가능성이 있는 가격이니, 이 숫자로 장기 계약을 설계하는 건 권하지 않습니다.

예정된 가격 변경: 지금 계약하면 어긋나는 이유

현재의 저가 구간 상당 부분은 기한부입니다. 아래 일정은 미리 알아두시는 게 좋습니다.

시점내용방향
2026-08-31Codex에서 GPT-5.4 / GPT-5.4 mini 은퇴, Terra·Luna로 대체마이그레이션 필요
2026-09-01Claude Sonnet 5 $3/$15 인상 예정이었으나 철회, $2/$10 표준가 유지인상 없음
2026-11-21GPT-5.6 Sol 프로모션 최소 보장 종료복귀 여부 확인 불가
2027-01-01Gemini 3.7 Flash / 3.6 Flash 도입가 종료, $0.75/$3.75에서 $1.50/$7.50으로인상 확정

연간 예산을 오늘 단가로 고정해두면 최소 두 지점(2026-11-21, 2027-01-01)에서 어긋나요.

실무자 관점 정리

숫자를 다 늘어놓았으니, 결론을 정리해볼게요.

지금 프론티어 모델이 필요하다면 Sol이 가격 우위예요($4/$20 vs Opus 5 $5/$25). 다만 2026-11-21 이후는 불확실하니, 모델을 갈아타기 쉬운 추상화 계층을 두는 편이 안전해요. 그리고 비용의 대부분은 모델 선택이 아니라 사용 방식에서 갈려요. 배치(50%)·캐싱(90%)·컨텍스트 임계 관리를 결합한 효과가 모델 간 단가 차이보다 큽니다. 순서를 바꿔 말하면, 모델을 바꾸기 전에 쓰는 방식부터 손보는 쪽이 빠릅니다. 경량 워크로드라면 Luna($0.20/$1.20)가 지금 최저가고, 7월 인하는 기한이 없어 상대적으로 안정적이죠. Gemini 3.7 Flash를 쓰고 계신다면 2027-01-01 2배 인상을 지금 예산에 미리 반영해두세요. Claude 계열과 비교할 땐 토크나이저 30% 가산을 반드시 얹어서 계산하셔야 해요. 안 그러면 가격표 단순 비교가 Claude에 유리하게 왜곡돼요.

한 가지 더 짚어볼게요. 커뮤니티 반응을 보면 기업 도입은 가격보다 데이터 보존 정책이 먼저라는 얘기가 많았어요. Hacker News의 가장 큰 스레드(635 pts)에서 논의의 중심이 가격이 아니라 Zero Data Retention(ZDR)으로 옮겨갔는데, Claude Fable·Mythos는 ZDR이 적용되지 않아 일부 기업에서 사용이 금지됐다는 증언도 여러 건 나왔고요. 다만 이 증언은 커뮤니티 발언이고 Anthropic 공식 문서로는 확인하지 못했으니, 도입 검토 시엔 각 사에 직접 확인하시는 편이 안전해요. 싸다고 바로 쓸 수 있는 게 아니라는 실무 제약이죠.

전반적인 정서는 순수한 환영보다 의심에 가까웠어요. "API 요금은 내리는데 왜 Codex 구독 사용 한도는 줄어드나"는 불만이 최상위 댓글로 올라왔고, 마진 논쟁도 활발했죠. 가격 인하 발표를 그대로 받아들이기보다 조건과 기한을 확인하는 습관, 지금이 그걸 들일 시점이에요.

지금 쓰는 모델 조합이 여전히 최선인지는 팀마다 달라요. 판단에 필요한 숫자는 위에 정리해 뒀으니, 자사 워크로드에 대입해 직접 계산해보셔도 충분해요.


마무리

이번 인하에서 실무자가 챙길 건 세 가지예요. 첫째, 내가 쓰는 모델의 인하가 정가 변경인지 기한부 프로모션인지 확인하기. 둘째, Claude와 비교할 땐 토크나이저 약 30% 가산을 얹어 계산하기. 셋째, 모델을 갈아타기 전에 배치·캐싱·컨텍스트 관리부터 점검하기.

가격표는 계속 움직입니다. 움직이지 않는 건 "지금 단가로 1년을 계산하면 안 된다"는 원칙 하나예요.


자주 묻는 질문 (FAQ)

Q: API 요금은 내렸는데, 왜 Codex 구독 사용 한도는 줄었다는 얘기가 나오나요?

OpenAI의 공식 설명은 아니지만, Hacker News 댓글에서 종량제 API 단가 인하와 동시에 Codex 유료 구독자의 주간 사용 한도가 줄었다는 불만이 다수 나왔습니다. 이번 조사 시점 기준으로 두 사안의 인과관계는 공식 확인되지 않았고, 커뮤니티 정서만 확보된 상태예요.

Q: GPT-5.6 Sol의 인하 가격은 계속 유지되나요?

아니요. OpenAI 공식 요금표에는 최소 2026년 11월 21일까지 보장한다고만 명시돼 있고, 그 이후 원래 가격($5/$30)으로 돌아갈지는 공식 언급이 없습니다. 장기 계약이나 연간 예산을 지금 단가로 고정하는 건 권하지 않아요.

Q: 요금표만 비교하면 Claude가 항상 더 비싼가요?

꼭 그렇지는 않아요. Sonnet 5는 GPT-5.6 Terra와 거의 같은 $2/$10~12 구간이고, Haiku 4.5는 Gemini 경량 모델보다 비싸고 Luna보다는 쌉니다. 다만 Claude 4.7 이후 모델은 새 토크나이저 때문에 같은 글을 약 30% 더 많은 토큰으로 계산하므로, 명목 단가만 비교하면 실제 비용 차이를 과소평가하게 돼요.


관련 글

참고 자료