AI API 요금 비교 (2026) — OpenAI·Anthropic·Google 토큰 단가와 비용 계산 기준

ChatGPT Plus나 Claude Pro 같은 월 구독제와 달리, API는 쓴 만큼 내는 토큰 종량제입니다. 문제는 단가표가 세 회사(OpenAI·Anthropic·Google)에 흩어져 있고, 같은 회사 안에서도 모델 등급에 따라 단가가 수십 배 차이 난다는 점입니다. 게다가 입력과 출력 단가가 다르고, 캐싱·배치 같은 할인 구조까지 겹쳐 “내 작업에 실제로 얼마가 드는지”를 가늠하기 어렵습니다. 이 글은 2026년 7월 3일 각 사 공식 요금 페이지에 게재된 단가를 기준으로 ① 토큰 과금 구조, ② 3사 대표 모델 단가 비교표, ③ 작업별 비용 계산 공식과 예시, ④ 공식적으로 제공되는 절감 수단 세 가지, ⑤ 구독 vs API 판단 기준을 정리한 분석입니다. 단가는 수시로 바뀌므로 결제 전 공식 페이지 재확인을 전제로 읽어 주세요.

토큰 과금 구조 — 입력과 출력 단가가 왜 다른가

API 요금은 “토큰”이라는 단위로 계산됩니다. 모델에 넣는 텍스트(프롬프트+문서)가 입력 토큰, 모델이 생성하는 답변이 출력 토큰이고, 두 단가가 다릅니다. 3사 모두 출력 단가가 입력 단가보다 5~6배가량 비싸게 책정되어 있어서(예: GPT-5.5는 입력 $5·출력 $30), 긴 답변을 뽑는 작업일수록 출력 단가가 전체 비용을 지배합니다.

토큰이 텍스트 양과 어떻게 대응하는지는 Anthropic 공식 문서가 기준을 제시합니다: 영어 기준 1토큰은 대략 4글자 또는 0.75단어입니다. 다만 “정확한 수는 언어와 콘텐츠 유형에 따라 달라진다”고 명시되어 있고, OpenAI 공식 자료도 비영어권 언어는 글자당 토큰 수가 영어보다 많아질 수 있음을 예시로 보여줍니다. 한국어에 대한 공식 환산 배수는 3사 어디에도 게재되어 있지 않으므로, 정확한 예산이 필요하면 각 사가 제공하는 토크나이저 도구나 토큰 카운트 API로 본인 텍스트를 직접 재보는 것이 유일하게 확실한 방법입니다.

3사 대표 모델 단가 비교 (2026년 7월 3일 공식 페이지 기준)

아래 표는 세 회사의 현행 텍스트 모델을 플래그십·중간·경량 등급으로 묶어 정리한 것입니다. 단위는 모두 100만(1M) 토큰당 USD입니다.

모델 제공사 입력 $/1M 출력 $/1M 비고
GPT-5.5 OpenAI 5.00 30.00 캐시 입력 $0.50
Claude Opus 4.8 Anthropic 5.00 25.00 캐시 히트 $0.50
Gemini 3.1 Pro (프리뷰) Google 2.00~4.00 12.00~18.00 프롬프트 20만 토큰 초과 시 상단 단가
GPT-5.4 OpenAI 2.50 15.00 캐시 입력 $0.25
Claude Sonnet 4.6 Anthropic 3.00 15.00 신형 Sonnet 5는 2026-08-31까지 $2/$10 한시 단가
Gemini 3.5 Flash Google 1.50 9.00 Flash 계열 최신
GPT-5.4-mini OpenAI 0.75 4.50 5.5 계열에는 mini·nano 없음
Claude Haiku 4.5 Anthropic 1.00 5.00 경량 최상위급
Gemini 3.1 Flash-Lite Google 0.25 1.50 오디오 입력은 $0.50
GPT-5.4-nano OpenAI 0.20 1.25 최저가 등급

표를 읽을 때 주의할 점 세 가지입니다. 첫째, Google의 Pro 플래그십은 현재 프리뷰(preview) 상태로 게재되어 있어 정식 출시 시 단가가 조정될 수 있습니다. 둘째, Gemini Pro 계열은 프롬프트가 20만 토큰을 넘으면 입력·출력 단가가 한 단계 올라가는 2단 가격제입니다(장문 문서 분석 시 체감 비용이 달라짐). 셋째, Anthropic의 Sonnet 5는 2026년 8월 31일까지 $2/$10 한시 단가가 적용되고 9월 1일부터 $3/$15로 환원된다고 공식 페이지에 명시되어 있습니다 — 한시 단가 기준으로 예산을 짜면 9월에 비용이 뛰니 표준 단가로 계산해 두는 편이 안전합니다.

공식 단가 페이지: OpenAI API Pricing · Anthropic Pricing · Gemini API Pricing

내 작업은 얼마가 들까 — 계산 공식과 예시 2개

계산 공식은 하나뿐입니다: 비용 = (입력 토큰 ÷ 1,000,000 × 입력 단가) + (출력 토큰 ÷ 1,000,000 × 출력 단가). 아래 두 예시는 토큰 수를 가정값으로 놓고 계산한 것이므로, 본인 작업의 실제 토큰 수는 토크나이저로 재서 대입해야 합니다.

예시 1 — 기사 요약 1,000건 (건당 입력 2,000토큰·출력 300토큰 가정): 입력 합계 2.0M, 출력 합계 0.3M 토큰. 요약처럼 입력이 많고 출력이 짧은 작업은 경량 모델의 영역입니다.

모델 입력 비용 출력 비용 합계
Gemini 3.1 Flash-Lite $0.50 $0.45 $0.95
GPT-5.4-mini $1.50 $1.35 $2.85
Claude Haiku 4.5 $2.00 $1.50 $3.50

예시 2 — 장문 초안 생성 100편 (편당 입력 500토큰·출력 2,500토큰 가정): 입력 합계 0.05M, 출력 합계 0.25M 토큰. 생성 위주 작업은 출력 단가가 비용의 90% 이상을 차지합니다. 플래그십 기준 GPT-5.5는 $0.25+$7.50=$7.75, Claude Opus 4.8은 $0.25+$6.25=$6.50, Gemini 3.1 Pro(20만 토큰 이하 구간)는 $0.10+$3.00=$3.10입니다. 같은 “플래그십”이라도 작업 단가가 2배 이상 벌어지는 셈이라, 품질 차이가 그 격차를 정당화하는지는 본인 작업으로 직접 비교 평가해야 합니다.

청구액을 줄이는 공식 레버 3가지 — 캐싱·배치·모델 티어링

① 프롬프트 캐싱. 매 요청마다 반복되는 부분(시스템 프롬프트, 참고 문서)을 캐시에 올려 재사용하는 기능입니다. Anthropic은 캐시 읽기가 기본 입력 단가의 0.1배(쓰기는 5분 캐시 1.25배·1시간 캐시 2배), OpenAI는 캐시된 입력이 정확히 기본 입력 단가의 10%로 게재되어 있습니다. Google도 컨텍스트 캐싱을 제공하며 모델별 단가는 공식 페이지에서 확인해야 합니다. 반복 프롬프트가 긴 자동화 파이프라인이라면 입력 비용을 크게 줄일 수 있는 첫 번째 수단입니다.

② 배치(Batch) API. 실시간 응답이 필요 없는 대량 작업을 비동기로 돌리면 3사 모두 50% 할인이 적용됩니다(Anthropic·Google은 50%를 명시, OpenAI는 배치 요금표가 표준가의 정확히 절반). 위 예시 1의 요약 1,000건 같은 작업을 배치로 돌리면 $0.95가 약 $0.48이 됩니다. 다만 결과 반환까지 수 시간이 걸릴 수 있어 대화형 서비스에는 부적합합니다.

③ 모델 티어링. 모든 단계에 플래그십을 쓰는 것이 가장 흔한 과지출 패턴입니다. 분류·추출·라우팅은 경량 모델, 초안 생성은 중간 모델, 최종 품질이 중요한 소수 작업만 플래그십으로 나누는 구조가 표준적인 설계입니다. 위 표 기준 경량과 플래그십의 출력 단가 차이는 최대 24배(GPT-5.4-nano $1.25 vs GPT-5.5 $30.00)에 달합니다.

구독이 나을까 API가 나을까 — 판단 기준

상황 권장 이유
브라우저에서 대화하며 쓰는 개인 사용 구독 (Plus·Pro 등) 정액제라 예산 예측이 쉽고 부가 기능 포함
스크립트·자동화로 반복 호출 API 구독 플랜은 자동화 호출 용도가 아니며, 종량제가 사용량에 정비례
월 사용량이 소량이고 불규칙 API (경량 모델) 몇 달러 수준으로 끝나는 경우가 많음
서비스·제품에 AI 기능 내장 API 사용자 수에 따라 탄력적으로 과금
일단 무료로 실험 Gemini API 무료 티어 Google은 상당수 모델에 무료 등급을 게재(한도·제외 모델 있음)

참고로 무료 실험 경로는 세 회사가 다릅니다. Google Gemini API는 요금 페이지에 무료 티어가 명시되어 있는 반면(일부 모델 제외), OpenAI와 Anthropic API는 기본적으로 선불 크레딧·유료 결제 기반입니다. 가입 프로모션이나 평가용 크레딧은 수시로 바뀌므로 각 사 콘솔에서 직접 확인하는 것이 정확합니다.

FAQ — 자주 묻는 질문

Q1. 원화로는 얼마인가요? 부가세는요?
3사 모두 USD로 청구됩니다. 원화 체감액은 결제 시점 환율과 카드사 해외결제 수수료에 따라 달라지고, 부가가치세 부과 여부·방식도 계정 유형(개인/사업자)과 등록 정보에 따라 다르므로 각 사 결제 문서와 본인 카드사 조건을 확인해야 합니다.

Q2. 이 단가는 언제까지 유효한가요?
이 글의 표는 2026년 7월 3일 공식 페이지 게재 기준입니다. 신모델 출시 때마다 단가 체계가 바뀌고, Sonnet 5의 한시 단가처럼 기한이 박힌 가격도 있습니다. 예산을 확정하기 전에는 반드시 위 공식 링크에서 당일 단가를 재확인하세요.

Q3. 같은 모델인데 컨텍스트 길이에 따라 단가가 달라진다는 게 무슨 뜻인가요?
Gemini Pro 계열은 한 번의 요청에 넣는 프롬프트가 20만 토큰을 넘으면 입력·출력 단가가 상향 구간으로 바뀝니다. 수백 페이지 문서를 통째로 넣는 작업이라면 이 구간 단가로 계산해야 실제 청구액과 맞습니다. OpenAI·Anthropic의 현행 표준 단가표는 이런 길이 구간 없이 단일 단가입니다.

Q4. 어떤 모델부터 시작하는 게 합리적인가요?
중간 등급(GPT-5.4, Claude Sonnet, Gemini Flash)으로 프로토타입을 만들고, 품질이 부족한 부분만 플래그십으로 올리고 품질이 남는 부분은 경량으로 내리는 방식이 비용 대비 검증이 빠릅니다. 처음부터 플래그십으로 시작하면 “이 작업에 그 품질이 필요했는지”를 영영 확인할 수 없습니다.

관련 글 더 보기

글쓴이

이 글은 AI툴랩 에디터가 각 서비스의 공식 요금 페이지·공식 문서·공개 자료를 종합해 작성한 분석입니다. 본문 단가는 2026년 7월 3일 공식 페이지 확인 기준이며, 요금과 정책은 수시로 바뀔 수 있으니 결제 전 공식 페이지에서 확인해 주세요. 정정 요청은 문의로 보내주세요.

댓글 남기기