ChatGPT Plus나 Claude Pro 같은 월 구독제와 달리, API는 쓴 만큼 내는 토큰 종량제입니다. 문제는 단가표가 세 회사(OpenAI·Anthropic·Google)에 흩어져 있고, 같은 회사 안에서도 모델 등급에 따라 단가가 수십 배 차이 난다는 점입니다. 게다가 입력과 출력 단가가 다르고, 캐싱·배치 같은 할인 구조까지 겹쳐 “내 작업에 실제로 얼마가 드는지”를 가늠하기 어렵습니다. 이 글은 2026년 7월 3일 각 사 공식 요금 페이지에 게재된 단가를 기준으로 ① 토큰 과금 구조, ② 3사 대표 모델 단가 비교표, ③ 작업별 비용 계산 공식과 예시, ④ 공식적으로 제공되는 절감 수단 세 가지, ⑤ 구독 vs API 판단 기준을 정리한 분석입니다. 단가는 수시로 바뀌므로 결제 전 공식 페이지 재확인을 전제로 읽어 주세요.
토큰 과금 구조 — 입력과 출력 단가가 왜 다른가
API 요금은 “토큰”이라는 단위로 계산됩니다. 모델에 넣는 텍스트(프롬프트+문서)가 입력 토큰, 모델이 생성하는 답변이 출력 토큰이고, 두 단가가 다릅니다. 3사 모두 출력 단가가 입력 단가보다 5~6배가량 비싸게 책정되어 있어서(예: GPT-5.5는 입력 $5·출력 $30), 긴 답변을 뽑는 작업일수록 출력 단가가 전체 비용을 지배합니다.
토큰이 텍스트 양과 어떻게 대응하는지는 Anthropic 공식 문서가 기준을 제시합니다: 영어 기준 1토큰은 대략 4글자 또는 0.75단어입니다. 다만 “정확한 수는 언어와 콘텐츠 유형에 따라 달라진다”고 명시되어 있고, OpenAI 공식 자료도 비영어권 언어는 글자당 토큰 수가 영어보다 많아질 수 있음을 예시로 보여줍니다. 한국어에 대한 공식 환산 배수는 3사 어디에도 게재되어 있지 않으므로, 정확한 예산이 필요하면 각 사가 제공하는 토크나이저 도구나 토큰 카운트 API로 본인 텍스트를 직접 재보는 것이 유일하게 확실한 방법입니다.
3사 대표 모델 단가 비교 (2026년 7월 3일 공식 페이지 기준)
아래 표는 세 회사의 현행 텍스트 모델을 플래그십·중간·경량 등급으로 묶어 정리한 것입니다. 단위는 모두 100만(1M) 토큰당 USD입니다.
| 모델 | 제공사 | 입력 $/1M | 출력 $/1M | 비고 |
|---|---|---|---|---|
| GPT-5.5 | OpenAI | 5.00 | 30.00 | 캐시 입력 $0.50 |
| Claude Opus 4.8 | Anthropic | 5.00 | 25.00 | 캐시 히트 $0.50 |
| Gemini 3.1 Pro (프리뷰) | 2.00~4.00 | 12.00~18.00 | 프롬프트 20만 토큰 초과 시 상단 단가 | |
| GPT-5.4 | OpenAI | 2.50 | 15.00 | 캐시 입력 $0.25 |
| Claude Sonnet 4.6 | Anthropic | 3.00 | 15.00 | 신형 Sonnet 5는 2026-08-31까지 $2/$10 한시 단가 |
| Gemini 3.5 Flash | 1.50 | 9.00 | Flash 계열 최신 | |
| GPT-5.4-mini | OpenAI | 0.75 | 4.50 | 5.5 계열에는 mini·nano 없음 |
| Claude Haiku 4.5 | Anthropic | 1.00 | 5.00 | 경량 최상위급 |
| Gemini 3.1 Flash-Lite | 0.25 | 1.50 | 오디오 입력은 $0.50 | |
| GPT-5.4-nano | OpenAI | 0.20 | 1.25 | 최저가 등급 |
표를 읽을 때 주의할 점 세 가지입니다. 첫째, Google의 Pro 플래그십은 현재 프리뷰(preview) 상태로 게재되어 있어 정식 출시 시 단가가 조정될 수 있습니다. 둘째, Gemini Pro 계열은 프롬프트가 20만 토큰을 넘으면 입력·출력 단가가 한 단계 올라가는 2단 가격제입니다(장문 문서 분석 시 체감 비용이 달라짐). 셋째, Anthropic의 Sonnet 5는 2026년 8월 31일까지 $2/$10 한시 단가가 적용되고 9월 1일부터 $3/$15로 환원된다고 공식 페이지에 명시되어 있습니다 — 한시 단가 기준으로 예산을 짜면 9월에 비용이 뛰니 표준 단가로 계산해 두는 편이 안전합니다.
공식 단가 페이지: OpenAI API Pricing · Anthropic Pricing · Gemini API Pricing
내 작업은 얼마가 들까 — 계산 공식과 예시 2개
계산 공식은 하나뿐입니다: 비용 = (입력 토큰 ÷ 1,000,000 × 입력 단가) + (출력 토큰 ÷ 1,000,000 × 출력 단가). 아래 두 예시는 토큰 수를 가정값으로 놓고 계산한 것이므로, 본인 작업의 실제 토큰 수는 토크나이저로 재서 대입해야 합니다.
예시 1 — 기사 요약 1,000건 (건당 입력 2,000토큰·출력 300토큰 가정): 입력 합계 2.0M, 출력 합계 0.3M 토큰. 요약처럼 입력이 많고 출력이 짧은 작업은 경량 모델의 영역입니다.
| 모델 | 입력 비용 | 출력 비용 | 합계 |
|---|---|---|---|
| Gemini 3.1 Flash-Lite | $0.50 | $0.45 | $0.95 |
| GPT-5.4-mini | $1.50 | $1.35 | $2.85 |
| Claude Haiku 4.5 | $2.00 | $1.50 | $3.50 |
예시 2 — 장문 초안 생성 100편 (편당 입력 500토큰·출력 2,500토큰 가정): 입력 합계 0.05M, 출력 합계 0.25M 토큰. 생성 위주 작업은 출력 단가가 비용의 90% 이상을 차지합니다. 플래그십 기준 GPT-5.5는 $0.25+$7.50=$7.75, Claude Opus 4.8은 $0.25+$6.25=$6.50, Gemini 3.1 Pro(20만 토큰 이하 구간)는 $0.10+$3.00=$3.10입니다. 같은 “플래그십”이라도 작업 단가가 2배 이상 벌어지는 셈이라, 품질 차이가 그 격차를 정당화하는지는 본인 작업으로 직접 비교 평가해야 합니다.
청구액을 줄이는 공식 레버 3가지 — 캐싱·배치·모델 티어링
① 프롬프트 캐싱. 매 요청마다 반복되는 부분(시스템 프롬프트, 참고 문서)을 캐시에 올려 재사용하는 기능입니다. Anthropic은 캐시 읽기가 기본 입력 단가의 0.1배(쓰기는 5분 캐시 1.25배·1시간 캐시 2배), OpenAI는 캐시된 입력이 정확히 기본 입력 단가의 10%로 게재되어 있습니다. Google도 컨텍스트 캐싱을 제공하며 모델별 단가는 공식 페이지에서 확인해야 합니다. 반복 프롬프트가 긴 자동화 파이프라인이라면 입력 비용을 크게 줄일 수 있는 첫 번째 수단입니다.
② 배치(Batch) API. 실시간 응답이 필요 없는 대량 작업을 비동기로 돌리면 3사 모두 50% 할인이 적용됩니다(Anthropic·Google은 50%를 명시, OpenAI는 배치 요금표가 표준가의 정확히 절반). 위 예시 1의 요약 1,000건 같은 작업을 배치로 돌리면 $0.95가 약 $0.48이 됩니다. 다만 결과 반환까지 수 시간이 걸릴 수 있어 대화형 서비스에는 부적합합니다.
③ 모델 티어링. 모든 단계에 플래그십을 쓰는 것이 가장 흔한 과지출 패턴입니다. 분류·추출·라우팅은 경량 모델, 초안 생성은 중간 모델, 최종 품질이 중요한 소수 작업만 플래그십으로 나누는 구조가 표준적인 설계입니다. 위 표 기준 경량과 플래그십의 출력 단가 차이는 최대 24배(GPT-5.4-nano $1.25 vs GPT-5.5 $30.00)에 달합니다.
구독이 나을까 API가 나을까 — 판단 기준
| 상황 | 권장 | 이유 |
|---|---|---|
| 브라우저에서 대화하며 쓰는 개인 사용 | 구독 (Plus·Pro 등) | 정액제라 예산 예측이 쉽고 부가 기능 포함 |
| 스크립트·자동화로 반복 호출 | API | 구독 플랜은 자동화 호출 용도가 아니며, 종량제가 사용량에 정비례 |
| 월 사용량이 소량이고 불규칙 | API (경량 모델) | 몇 달러 수준으로 끝나는 경우가 많음 |
| 서비스·제품에 AI 기능 내장 | API | 사용자 수에 따라 탄력적으로 과금 |
| 일단 무료로 실험 | Gemini API 무료 티어 | Google은 상당수 모델에 무료 등급을 게재(한도·제외 모델 있음) |
참고로 무료 실험 경로는 세 회사가 다릅니다. Google Gemini API는 요금 페이지에 무료 티어가 명시되어 있는 반면(일부 모델 제외), OpenAI와 Anthropic API는 기본적으로 선불 크레딧·유료 결제 기반입니다. 가입 프로모션이나 평가용 크레딧은 수시로 바뀌므로 각 사 콘솔에서 직접 확인하는 것이 정확합니다.
FAQ — 자주 묻는 질문
Q1. 원화로는 얼마인가요? 부가세는요?
3사 모두 USD로 청구됩니다. 원화 체감액은 결제 시점 환율과 카드사 해외결제 수수료에 따라 달라지고, 부가가치세 부과 여부·방식도 계정 유형(개인/사업자)과 등록 정보에 따라 다르므로 각 사 결제 문서와 본인 카드사 조건을 확인해야 합니다.
Q2. 이 단가는 언제까지 유효한가요?
이 글의 표는 2026년 7월 3일 공식 페이지 게재 기준입니다. 신모델 출시 때마다 단가 체계가 바뀌고, Sonnet 5의 한시 단가처럼 기한이 박힌 가격도 있습니다. 예산을 확정하기 전에는 반드시 위 공식 링크에서 당일 단가를 재확인하세요.
Q3. 같은 모델인데 컨텍스트 길이에 따라 단가가 달라진다는 게 무슨 뜻인가요?
Gemini Pro 계열은 한 번의 요청에 넣는 프롬프트가 20만 토큰을 넘으면 입력·출력 단가가 상향 구간으로 바뀝니다. 수백 페이지 문서를 통째로 넣는 작업이라면 이 구간 단가로 계산해야 실제 청구액과 맞습니다. OpenAI·Anthropic의 현행 표준 단가표는 이런 길이 구간 없이 단일 단가입니다.
Q4. 어떤 모델부터 시작하는 게 합리적인가요?
중간 등급(GPT-5.4, Claude Sonnet, Gemini Flash)으로 프로토타입을 만들고, 품질이 부족한 부분만 플래그십으로 올리고 품질이 남는 부분은 경량으로 내리는 방식이 비용 대비 검증이 빠릅니다. 처음부터 플래그십으로 시작하면 “이 작업에 그 품질이 필요했는지”를 영영 확인할 수 없습니다.
관련 글 더 보기
- Claude Code 요금제 가이드 (2026) — Pro vs Max, 모델 선택 기준
- ChatGPT Plus vs Claude Pro 가격 비교 (2026) — 실청구액·연결제 기준
글쓴이
이 글은 AI툴랩 에디터가 각 서비스의 공식 요금 페이지·공식 문서·공개 자료를 종합해 작성한 분석입니다. 본문 단가는 2026년 7월 3일 공식 페이지 확인 기준이며, 요금과 정책은 수시로 바뀔 수 있으니 결제 전 공식 페이지에서 확인해 주세요. 정정 요청은 문의로 보내주세요.