본문으로 건너뛰기
블로그로 돌아가기
[TUTORIAL]

AI 계약 할인, 뭘 따져야 할까요? OpenAI vs Anthropic 가격 협상 2026 기준 5가지

퀀텀점프클럽 정상록퀀텀점프클럽 정상록16분 읽기4 views

무료 자료

PDF · 무료

AI 요금 계약서, 할인율보다 먼저 볼 한 줄 — 비개발자를 위한 쉬운 가이드

긴 글을 다 읽기 전에, 실무 가이드부터 먼저 챙겨가세요.

AI 계약 할인, 뭘 따져야 할까요? OpenAI vs Anthropic 가격 협상 2026 기준 5가지

핵심: 계약서에서 먼저 볼 것은 할인율이 아니라 한도를 넘은 뒤 할인이 어떻게 되는지입니다.

AI 계약 할인, 왜 갑자기 협상 의제가 됐나요?

AI 계약 할인은 할인율 숫자 하나로는 비교가 안 됩니다. 한도를 넘는 순간 할인이 사라지는지 유예가 있는지에 따라 연말 청구서가 달라지거든요.

"우리 약정, 한도 넘으면 어떻게 되죠?" "단가가 내렸다는데 청구서는 왜 그대로죠?" 계약을 맡은 실무자라면 한 번쯤 속으로 던져 본 질문일 거예요. 벤더를 하나로 몰자니 묶일 것 같고 나누자니 관리가 일이라 망설여지는 마음도 자연스럽습니다.

이 글은 2026-09-28 The Information 보도와 2026-10-08에 직접 확인한 양사 공식 가격표를 나란히 놓고 한도 초과 조항, 인하율의 기준선, 중국 모델 대체 가능성을 아래 순서대로 살펴봅니다. 상대 수치에는 전부 무엇 대비인지를 붙였어요.

약정 한도를 넘으면 할인은 어떻게 되나요?

The Information의 Kevin McLaughlin 기자가 2026-09-28 보도한 내용에 따르면 Anthropic은 고객이 약정 한도에 닿는 즉시 할인을 끊습니다. 약정(commit)은 일정 사용량을 미리 약속하고 단가 할인을 받는 계약이고 한도는 계약 토큰(AI가 글을 쪼개 세는 단위) 수예요. 같은 보도에서 OpenAI는 당월 잔여 기간에 한 달을 더한 재협상 유예를 두고 유예가 끝나면 정가를 적용합니다. 클라우드 3사(AWS·Microsoft·Google)는 계약 기간 내내 초과분에도 할인을 유지하는 편이라고 NPI Financial의 Jeff Muscarella가 말했습니다.

항목AnthropicOpenAI클라우드 3사
한도 초과 시 할인즉시 종료유예 기간 동안 유지계약 기간 내내 유지
재협상 유예없음당월 잔여 + 1개월해당 없음
유예 후정가정가해당 없음
할인율정가(list price) 대비 약 15%공개 수치 없음공개 수치 없음

출처의 성격부터 밝혀 둘게요. 할인 절벽(한도에 닿는 순간 할인이 한꺼번에 사라지는 구조)과 15%는 양사와 모두 거래하는 소프트웨어 기업 관리자 3곳의 증언이고 OpenAI 유예 조건은 소프트웨어 라이선싱 자문가의 증언입니다. Anthropic은 논평을 거부했고 양사 공식 가격 문서에는 할인·약정 조항이 없어요(2026-10-08 확인). 원문은 유료라 같은 날 나온 The Next Web 정리본으로 확인했으며 TNW도 독자 검증은 하지 않았다고 밝혔습니다.

규모는 작지 않습니다. The Information에 따르면 2026-06까지 12개월 동안 Anthropic에 연 1,000만 달러(약 133.9억 원) 이상을 쓴 기업이 100곳을 넘었고 연 100만 달러(약 13.4억 원) 이상은 1,000곳을 넘었어요. CodeRabbit의 Harjot Gill CEO는 주 공급사가 2026년 3월경까지 Anthropic이었고 지금은 OpenAI라고 밝혔습니다.

돈으로 바꿔 보죠. 정가 기준 연 100만 달러어치를 쓰는 고객에게 15%를 적용하면 할인 가치는 연 약 2억 원입니다(2026-10-07 환율 1달러 1,338.92원 기준 산술). 한도 초과분이 정가로 청구되면 이 가치를 깎아 먹는 구간이 생길 수 있어서 협상 순서는 할인율보다 초과분 조항이 먼저예요. Greyhound Research의 Sanchit Vir Gogia는 CIO·InfoWorld 2026-09-23 기사에서 이 흐름을 "기업이 지능을 구매하는 기본 경로를 차지하려는 영토 확보전"이라고 불렀습니다.

Opus 5.5의 운영비 절감과 단가 인하는 왜 숫자가 다른가요?

CNBC가 2026-09-22 보도한 바에 따르면 Anthropic은 Claude Opus 5.5를 토큰 효율을 높인 버전이라고 소개하며 직전 세대 Opus 5보다 운영 비용이 약 40% 저렴하다고 설명했습니다. 2026-10-08에 확인한 Anthropic 공식 가격표는 다른 숫자를 보여줘요. 100만 토큰당 Opus 5.5는 입력 $4·출력 $20, Opus 5는 입력 $5·출력 $25라서 토큰당 정가 인하는 입력과 출력 모두 Opus 5 대비 20%입니다.

두 숫자는 모순이 아니라 구성이 다릅니다. 40%는 단가 인하에 토큰 사용량 감소 가정을 곱한 값이에요.

구성 요소비율기준선과 근거
토큰당 정가0.80배 (20% 인하)Opus 5($5/$25) 대비, 공식 가격표로 확정
같은 작업의 토큰 사용량0.75배 (약 25% 감소)40%가 성립하려면 필요한 역산값
합산 운영비0.60배 (40% 절감)Opus 5 대비, Anthropic 설명(CNBC 2026-09-22)

두 번째 줄이 빠지면 40%는 성립하지 않아요. Anthropic의 제품·리서치·랩 총괄 Dianne Penn은 CNBC 인터뷰에서 이렇게 말했습니다. "저희가 계속 개선하고 있는 것 중 하나는 그 사고 과정과 답변을 더 효율적으로 만들어서, effort 설정에 따라 토큰을 덜 쓰게 하는 것입니다." effort는 모델이 답하기 전에 얼마나 오래 생각할지 정하는 설정이에요. 그러니 40%는 가격 약속이 아니라 설정과 워크로드(실제 업무 사용 패턴)에 따라 달라지는 추정치입니다. 예산과 계약에 쓸 수 있는 확정값은 20%이고 나머지는 자사 업무에서 재현돼야 실현돼요.

토큰당 인하율이 실제 인하율과 다른 경우

Anthropic 공식 문서는 Claude 4.7 이후 모델이 같은 텍스트에 대해 약 30% 더 많은 토큰을 만드는 새 토크나이저(글을 토큰으로 쪼개는 방식)를 쓴다고 밝힙니다. 정확한 증가폭은 콘텐츠와 워크로드에 따라 달라진다는 단서도 붙어 있어요. 이 고지를 적용하면 Sonnet 4.6 입력 $3에서 Sonnet 5.5 입력 $2로 내려간 33.3%(직전 세대 대비 토큰당 인하율)는 같은 글을 처리하는 비용으로는 13.3%가 됩니다. $2에 1.3을 곱한 $2.60이 이전 단가 $3보다 13.3% 낮다는 계산이에요. Opus 5에서 Opus 5.5처럼 양쪽 모두 새 토크나이저면 보정이 필요 없고 표면 인하율이 곧 실효 인하율입니다.

'반값'이라는 말에는 기준선이 세 개 있습니다

"50% 인하"라는 표현에는 서로 다른 사건이 섞여 있어요. 한 문장으로 합치면 안 됩니다.

  • 2026-08-17 OpenRouter·Vercel 게이트웨이(여러 모델을 한 창구로 묶어 파는 중개 서비스) 프로모션은 당시 게이트웨이 경유 GPT-5.6 Sol 단가(입력 $5·출력 $30) 대비 50%였습니다. OpenAI 정가가 바뀐 것이 아니고 Vercel 쪽은 2026-09-18에 끝났어요(ExplainX 2026-08-18, 2차 출처).
  • 2026-08-22 OpenAI 공식 인하는 GPT-5.6 Sol 입력가를 인하 직전 정가 대비 20%($5에서 $4) 낮춘 것입니다. 현재가 $4는 공식 가격표에서 확인했고 직전가 $5는 2차 출처 기준이에요.
  • 2026-09-22 GPT-6 계열 출시가는 CNBC 보도에 따르면 GPT-5.6 Sol 프로모션가 대비 50%입니다. 공식 가격표에서도 gpt-6.1-sol(입력 $2·출력 $10)과 GPT-5.6 Sol 프로모션가(입력 $4·출력 $20)로 맞아떨어져요.

OpenAI 공식 가격 문서는 GPT-5.6 Sol 프로모션가가 "최소 2026-11-21까지" 유효하다고 적고 있습니다. 이 가격을 기준선으로 세운 예산에는 만료일이 있다는 뜻이에요.

중국 모델이 더 싸다는 말은 어디까지 맞나요?

등급을 정해야 답이 나옵니다. 아래는 2026-10-08 각사 공식 가격 문서에서 확인한 출력 100만 토큰당 정가예요. 등급은 가격대로 묶은 분류라서 성능이 같다는 뜻은 아닙니다.

가격대 등급미국 모델DeepSeek더 싼 쪽
프런티어gpt-6-astra $50 · Claude Opus 5.5 $20v4-pro 피크 $3.96 · 할인시간대 $1.98DeepSeek
중급Claude Sonnet 5.5 $10v4-pro 피크 $3.96 · 할인시간대 $1.98DeepSeek
소형Claude Haiku 5.5 $0.50(프롬프트 10만 토큰 이하) · gpt-6-luna $0.50(짧은 컨텍스트)flash 할인시간대 $0.60 · 피크 $1.20미국 모델

프런티어와 중급에서는 DeepSeek가 확실히 쌉니다. Opus 5.5 출력 $20은 v4-pro 피크 출력 $3.96의 약 5.1배예요. 소형 등급은 반대로 뒤집힙니다. 다만 Haiku 5.5는 프롬프트가 10만 토큰을 넘으면 출력이 $2.50으로 10만 토큰 이하 대비 5배 뛰어요. 긴 문서를 통째로 넣는 작업이라면 이 역전은 성립하지 않습니다.

할인시간대 단가로 예산을 세우면 청구서와 어긋납니다. DeepSeek 공식 문서에서 피크는 UTC 월금 01:0004:00과 06:0010:00(중국 공휴일 제외)인데 한국시간으로 바꾸면 월금 10:0013:00과 15:0019:00예요. 업무시간 상당 부분이 피크 단가를 적용받고 할인시간대 단가는 피크의 절반입니다. 대량 동시 처리라면 공식 동시성 한도(flash 2,500, v4-pro 500)도 확인해야 해요.

이탈 압력이 있는지는 전문가 사이에서도 의견이 갈립니다. Gartner의 Anushree Verma는 CIO·InfoWorld 2026-09-23 기사에서 "모델이 점점 범용재가 되고 있다"(commodity, 어느 회사 것이든 비슷해서 가격으로 고르게 되는 상품)고 말했습니다. 반면 2026-09-29 Hacker News 스레드(1,067점)에서 상위에 오른 coderenegade의 댓글은 이렇습니다. "OpenAI·Anthropic과 중국 랩 사이에는 여전히 상당한 격차가 있고, 오히려 벌어지고 있다." 어느 쪽이 맞는지는 공개 벤치마크가 아니라 자사 업무로 검증해야 합니다.

중국 모델에 맡기면 데이터는 어디로 가나요?

오픈웨이트(학습이 끝난 모델 파일을 내려받아 직접 돌릴 수 있게 공개한 모델)의 장점으로 Bloomberg 보도를 요약한 Finimize(2026-09-21)가 꼽은 것은 자사 데이터로 추가 학습하고 자기 시스템 안에서 돌릴 수 있다는 점입니다. 그런데 API로 부르는 것과 파일을 받아 직접 호스팅하는 것은 전혀 다른 선택이에요. API 호출이면 데이터가 해당 사업자 서버로 가므로 데이터 주권 이점이 없습니다. 2026-08-24 Hacker News 스레드에서 petcat은 이렇게 썼어요. "오픈웨이트는 오픈소스와 같지 않다. 지금의 오픈웨이트 모델은 웹 API 대신 자기 컴퓨터에서 돌릴 수 있는 불투명한 바이너리 블롭일 뿐이다."

한국 법제상 중국 모델 사용 제약은 이번 조사에서 확인하지 못했습니다. 금융·공공·의료 같은 규제 산업이라면 법률 검토가 먼저예요. 반대편 비용도 있습니다. OpenAI 공식 가격 페이지는 2026-03-05 이후 출시 모델의 지역 처리(데이터 레지던시) 엔드포인트에 같은 모델 표준 엔드포인트 단가 대비 10%를 더 받는다고 명시해요.

협상 전에 무엇부터 확인해야 하나요?

코드를 몰라도 계약서와 공식 가격표만 있으면 확인할 수 있는 항목입니다. 순서대로 가볼게요.

  1. 초과분 조항부터 읽습니다. 약정 한도를 넘긴 사용량이 할인가인지 정가인지, 유예가 며칠인지, 재협상이 안 풀리면 어떤 단가가 적용되는지가 계약서 문구로 있어야 해요. The Information 2026-09-28 보도 기준으로 Anthropic은 유예 없이 할인이 끝나고 OpenAI는 당월 잔여 기간에 한 달을 더한 유예를 준다고 하니 구두 설명만으로는 부족합니다. 한도를 못 채웠을 때의 미달분 청구와 이월 여부는 공개 자료로 확인되지 않아 질의 항목으로 남겨 두세요.
  2. 토큰당 단가표 대신 작업 1건당 비용으로 비교합니다. 자사 프롬프트 표본을 벤더별 토크나이저로 돌려 같은 작업의 비용을 계산하는 방식이에요. Gogia가 제시한 척도도 "승인되고 정책을 준수한 결과물당 총비용"이었습니다. OpenAI 공식 가격표 기준으로 긴 컨텍스트는 짧은 컨텍스트 단가의 약 2배이고 처리 모드는 Standard 단가의 50%(Batch·Flex)에서 600%(Ultrafast)까지 갈립니다. 벤더가 "운영비 N% 절감"을 내밀면 단가 인하분과 토큰 효율 가정분을 나눠 달라고 하세요. 이 비교표가 곧 가격 협상 자료가 됩니다.
  3. 지출 상한을 기능으로 확인합니다. Anthropic 공식 가격 페이지(2026-10-08 확인)에서 Enterprise 플랜은 시트당 월 $20(연간 청구)에 API 정가 기준 사용량 요금이 더해지는 구조예요. 관리자가 사용자·조직 단위 지출 한도를 설정하는 기능은 Enterprise 전용으로 표기돼 있습니다. 2~150명 대상인 Team 플랜에는 이 기능이 없어요. 같은 호출 수라도 단가가 달라지니 상한은 호출 수가 아니라 금액으로 걸어야 합니다.
  4. 작업을 등급별로 나눠 멀티벤더로 설계합니다. 대량·단순 작업은 소형 모델, 고난도 작업은 프런티어 모델, 품질 허용 폭이 넓은 중간 작업만 대안 모델을 검토하는 3분할이 위 가격표에서 나오는 구조예요. 한 벤더에 큰 약정을 걸수록 라우팅(요청을 작업 성격에 맞는 모델로 보내는 일) 자유가 줄고 할인 절벽에 노출되는 구간도 커집니다. 사용량 예측이 부정확할수록 큰 약정이 불리해요.
  5. share of wallet 조항은 서명 전에 법률 검토를 받습니다. AI 예산의 과반을 자사 플랫폼에 쓰기로 약속하는 조항(지갑 점유율 약속)인데 The Information 2026-09-28 보도에 따르면 양사 모두 대형 할인 계약에 넣기 시작했고 컨설턴트들은 어느 쪽도 이행을 검증할 수 없다고 봅니다. 검증이 어렵다는 건 위반 판정 기준이 모호하다는 뜻이지 안전하다는 보증이 아니에요. "AI 예산"에 들어가는 비용 항목, 산정 주기, 측정 주체, 미달 시 할인이 소급 취소되는지를 문구로 확정해야 합니다. 실제 계약 문구와 한국법상 효력은 이번 조사에서 확인하지 못했어요.

마무리

AI 계약 할인은 숫자 하나가 아니라 기준선과 조항의 묶음입니다. 확인된 내용만 줄이면 이래요. 한도를 넘으면 할인이 끊긴다는 증언이 보도됐고(The Information 2026-09-28), Opus 5.5의 확정 인하율은 Opus 5 대비 20%입니다. 중국 모델의 가격 우위는 등급에 따라 뒤집혀요.

천천히 검토하셔도 됩니다. 궁금한 지점이 생기면 그때 더 깊은 자료를 찾아보세요.


자주 묻는 질문

약정 한도를 넘으면 정말 정가로 돌아가나요?

Anthropic은 그렇다고 보도됐고 OpenAI는 유예 뒤에 정가가 됩니다. The Information 2026-09-28 보도에 따르면 Anthropic은 한도에 닿는 즉시 정가 대비 약 15% 할인이 끝나고 OpenAI는 당월 잔여 기간에 한 달을 더한 유예 뒤 정가를 적용해요. 둘 다 바이어 측 증언이고 양사 공식 확인은 없으니 우리 계약서의 초과분 조항을 직접 읽어 보세요.

중국 모델로 갈아타면 비용이 얼마나 줄어드나요?

등급에 따라 달라서 한 숫자로 답할 수 없어요. 2026-10-08 공식 가격표 기준 출력 100만 토큰당 Claude Opus 5.5는 $20, DeepSeek v4-pro는 피크 $3.96이라 프런티어급은 차이가 큽니다. 소형 등급에서는 Claude Haiku 5.5와 gpt-6-luna($0.50)가 DeepSeek flash 할인시간대($0.60)보다 쌉니다. 성능이 같은지는 자사 작업으로 따로 검증해야 합니다.

예산 초과를 막는 지출 상한 기능이 있나요?

Anthropic은 Enterprise 플랜에서만 확인됩니다. Anthropic 공식 가격 페이지(2026-10-08 확인)에서 관리자의 사용자·조직 단위 지출 한도 설정은 Enterprise 전용으로 표기돼 있고, Enterprise는 시트당 월 $20(연간 청구)에 API 정가 기준 사용량 요금이 더해지는 구조예요. 이 기능이 없는 티어로 사용량 과금 계약을 하면 초과를 청구서로 알게 됩니다.


참고 자료