작성 : Shai| AI Harness Developer
지난 글에서는 GPT·Claude·Gemini·DeepSeek의 대표 모델을 같은 기준으로 놓고 전체적인 API 비용을 비교해봤어요. 네 회사의 가격 차이를 먼저 보고 싶다면 아래 글을 참고해보세요.
→ 2026년 하반기 AI API 가격 비교 : GPT·Claude·Gemini·DeepSeek 100만 토큰 비용 총정리
2026년 하반기 AI API 가격 비교 : GPT·Claude·Gemini·DeepSeek 100만 토큰 비용 총정리
Shai | AI Harness Developer AI 서비스를 처음 만들 때는 아무래도 모델 성능부터 보게 돼요. 저도 새로운 모델이 나오면 벤치마크나 코딩 성능, 추론 능력부터 확인하는 편인데요. 그런데 실제 서비스
shai-devit.tistory.com
Claude도 모델에 따라 비용이 두 배, 네 배씩 달라져요
AI API를 처음 붙일 때는 모델 이름부터 보게 돼요. “Opus가 제일 좋다더라”, “Sonnet이 코딩에 좋다더라” 같은 이야기를 먼저 접하기 때문이죠. 그런데 실제로 서비스를 만들려고 가격표를 열어보면 질문이 조금 달라집니다.
“그래서 한 달에 얼마가 나오는 건데?”
저도 API 비용을 비교할 때 모델의 100만 토큰 가격만 보고 끝내지 않아요. 입력과 출력 비율이 어떤지, 긴 문서를 반복해서 넣는지, 캐시를 쓸 수 있는지, 실시간 응답이 꼭 필요한지를 같이 봅니다. 같은 Claude를 사용하더라도 이 조건에 따라 실제 청구액이 꽤 크게 달라지기 때문이에요.
특히 2026년 9월은 Claude 가격을 다시 확인할 이유가 생겼습니다. Anthropic은 9월 22일 Claude Opus 5.5를, 9월 28일 Claude Sonnet 5.5를 공개했어요. Opus 5.5는 장시간 에이전트 코딩과 지식 작업을, Sonnet 5.5는 속도와 지능의 균형을 강조하고 있습니다. 현재 대표적인 저비용 모델인 Haiku 4.5까지 함께 놓고 보면 용도에 따른 가격 차이가 꽤 뚜렷해요.
이번 글에서는 2026년 9월 30일 기준 Claude API 가격을 Anthropic 공식 문서를 기준으로 정리해볼게요. 단순히 가격표만 옮기는 것이 아니라 100만 토큰 비용, 실제 사용량을 넣었을 때의 월 예상 비용, Prompt Caching과 Batch API까지 함께 살펴보겠습니다.
Claude 모델별 100만 토큰 가격부터 맞춰볼게요
현재 Claude API의 대표 모델을 같은 기준으로 놓으면 가격 구조가 꽤 단순하게 보입니다.
모델입력 100만 토큰출력 100만 토큰입력·출력 각각 100만 사용 시
| Claude Opus 5.5 | $4 | $20 | $24 |
| Claude Sonnet 5.5 | $2 | $10 | $12 |
| Claude Haiku 4.5 | $1 | $5 | $6 |
Anthropic 공식 가격표 기준으로 Opus 5.5는 입력 100만 토큰당 4달러, 출력은 20달러예요. Sonnet 5.5는 입력 2달러와 출력 10달러, Haiku 4.5는 입력 1달러와 출력 5달러입니다.
표를 보면 일정한 패턴이 보이죠. 세 모델 모두 출력 가격이 입력 가격의 5배예요.
여기서 Claude API 가격을 처음 보는 분들이 흔히 하는 오해가 있습니다.
“Sonnet 5.5가 100만 토큰당 2달러라면 100만 토큰 정도 사용할 때 2달러겠지?”
라고 생각하기 쉬워요.
하지만 2달러는 어디까지나 입력 토큰 단가입니다. 사용자가 보낸 프롬프트가 100만 토큰이고 Claude가 답변으로 100만 토큰을 생성했다면 입력 2달러와 출력 10달러가 합쳐져 12달러가 됩니다.
실제 서비스에서는 입력과 출력의 비율이 일정하지 않기 때문에 단순히 입력 단가 하나만 보고 비용을 계산하면 오차가 커질 수 있어요.
긴 문서를 읽히고 짧은 요약만 받는 서비스와, 짧은 질문을 받고 긴 보고서를 만드는 서비스는 같은 모델을 사용해도 비용 구조가 완전히 다릅니다.
Opus 5.5, Sonnet 5.5, Haiku 4.5는 실제로 얼마나 차이 날까요?
조금 더 현실적인 상황으로 계산해볼게요.
한 달 동안 입력 1,000만 토큰과 출력 500만 토큰을 사용한다고 가정하겠습니다. 소규모 AI 기능을 테스트하거나 내부 업무 도구를 운영하면서 충분히 생각해볼 수 있는 규모예요.
Opus 5.5는 입력 비용이 40달러, 출력 비용이 100달러로 총 140달러가 됩니다.
Sonnet 5.5는 입력 20달러와 출력 50달러를 합쳐 70달러예요.
Haiku 4.5는 입력 10달러와 출력 25달러를 합쳐 35달러입니다.
같은 토큰을 사용해도 Opus와 Haiku 사이에 네 배 차이가 생깁니다.
그렇다고 바로
“그럼 Haiku만 쓰면 되겠네.”
라고 결론 내리면 조금 위험해요. Claude API 가격은 모델 선택의 중요한 기준이지만 유일한 기준은 아니기 때문입니다.
복잡한 코딩이나 여러 단계를 이어가는 에이전트 작업에서 저렴한 모델로 두세 번 다시 시도해야 한다면 실제 작업 한 건당 비용은 달라질 수 있어요.
반대로 정형화된 분류나 짧은 응답처럼 난도가 높지 않은 작업까지 상위 모델로 처리하면 필요 이상의 비용을 쓰게 됩니다.
제가 가격표를 볼 때도 “가장 싼 모델이 무엇인가?”보다 **“이 작업을 한 번 성공시키는 데 얼마가 드는가?”**를 먼저 생각하는 편이에요.
토큰 단가와 결과 품질을 따로 떼어놓으면 실제 운영비를 제대로 보기 어렵습니다.
실제 서비스라면 비용 차이가 더 크게 느껴져요
이번에는 문서 분석 서비스를 하나 가정해볼게요.
한 달에 2만 건의 요청을 처리하고, 요청 한 건마다 평균 입력 4,000토큰과 출력 1,000토큰을 사용한다고 해보겠습니다.
그러면 한 달 입력량은 8,000만 토큰, 출력량은 2,000만 토큰이에요.
이 조건에서 Opus 5.5를 사용하면 입력 320달러와 출력 400달러를 합쳐 약 720달러가 됩니다.
Sonnet 5.5는 입력 160달러와 출력 200달러를 합쳐 약 360달러, Haiku 4.5는 입력 80달러와 출력 100달러를 합쳐 약 180달러예요.
사용량이 늘어나면 100만 토큰당 1~2달러의 차이가 더 이상 작은 숫자가 아니게 됩니다.
이런 계산이 필요한 이유는 실제 서비스에서는 모델 비용이 매출이나 고객 한 명당 원가와 연결되기 때문이에요.
월 이용료가 10달러인 서비스를 만든다고 해도 사용자 한 명이 사용하는 API 비용이 1달러인지 5달러인지에 따라 사업 구조가 크게 달라집니다.
그래서 Claude API 가격을 비교할 때는 공식 가격표를 확인한 뒤 내 서비스의 평균 입력 길이와 평균 출력 길이를 실제로 넣어보는 과정이 꼭 필요합니다.
Prompt Caching은 반복되는 긴 문맥에서 의미가 커요
Claude 가격표에서 기본 입력과 출력 다음으로 눈여겨볼 부분이 Prompt Caching이에요.
Sonnet 5.5를 기준으로 일반 입력은 100만 토큰당 2달러입니다. 5분 캐시를 새로 작성할 때는 2.50달러, 1시간 캐시 작성은 4달러이고 이미 만들어진 캐시를 읽을 때는 0.20달러예요.
Opus 5.5는 기본 입력 4달러, 5분 캐시 작성 5달러, 1시간 캐시 작성 8달러이며 캐시 읽기는 0.20달러입니다.
Haiku 4.5는 기본 입력 1달러, 5분 캐시 작성 1.25달러, 1시간 캐시 작성 2달러, 캐시 읽기는 0.10달러예요.
처음 보면
“캐시를 쓰는데 왜 작성 비용은 더 비싸지?”
라는 생각이 들 수 있습니다.
캐싱은 한 번 저장하는 것 자체보다 같은 앞부분을 반복해서 읽을 때 의미가 커요.
예를 들어 매 요청마다 같은 사내 규정 5만 토큰을 다시 보내는 챗봇이 있다고 해볼게요. 첫 캐시 작성에는 추가 비용이 들더라도 이후 여러 요청에서 같은 문맥을 재사용한다면 캐시 읽기 단가를 적용받을 수 있습니다.
반대로 매번 완전히 다른 프롬프트를 보내는 서비스라면 캐싱의 효과가 크지 않을 수 있어요.
따라서 캐시 가격이 저렴하다는 이유만으로 모든 입력을 캐시 단가로 계산하면 실제 청구액과 상당한 차이가 생길 수 있습니다.
이 부분은 Claude API 가격을 계산할 때 생각보다 자주 놓치는 부분이에요.
Batch API는 실시간 응답이 필요 없다면 꽤 매력적이에요
Anthropic은 Batch API의 입력과 출력 토큰을 표준 가격의 50% 수준으로 제공합니다.
Sonnet 5.5를 예로 들면 일반 API에서는 입력 2달러, 출력 10달러지만 Batch에서는 입력 1달러, 출력 5달러예요.
Opus 5.5는 입력 2달러와 출력 10달러, Haiku 4.5는 입력 0.50달러와 출력 2.50달러로 내려갑니다.
앞에서 계산했던 입력 1,000만 토큰과 출력 500만 토큰을 모두 Batch로 처리할 수 있다고 단순 가정하면 Sonnet 5.5 비용은 70달러에서 약 35달러까지 줄어듭니다.
물론 모든 서비스를 Batch로 바꿀 수 있는 것은 아니에요.
사용자가 질문을 던지고 바로 답을 기다리는 챗봇이라면 실시간 응답이 필요합니다.
반면 밤사이에 수천 개 문서를 요약하거나 리뷰를 분류하고 다음 날 결과를 확인해도 되는 업무라면 Batch가 훨씬 잘 맞을 수 있어요.
결국 실시간성이 정말 필요한 업무인지 따져보는 것만으로도 비용 구조가 크게 달라질 수 있습니다.
긴 문서를 넣으면 무조건 별도 할증이 붙을까요?
이 부분도 다른 AI API를 사용해본 분들이 헷갈릴 만한 부분이에요.
Anthropic 공식 가격 문서에 따르면 Claude 4.6 이후 모델은 100만 토큰 컨텍스트 윈도 안에서도 표준 토큰 가격이 적용됩니다.
즉 9,000토큰짜리 요청과 90만 토큰짜리 요청에서 토큰 하나당 단가가 별도로 올라가는 구조는 아니라는 의미예요. 물론 실제 총비용은 사용한 토큰 수가 많아진 만큼 증가합니다.
현재 Opus 5.5와 Sonnet 5.5는 최대 100만 토큰 컨텍스트, Haiku 4.5는 20만 토큰 컨텍스트를 지원합니다.
또 하나 눈여겨볼 부분이 있어요.
Anthropic은 Claude 4.7 이후 모델이 새로운 토크나이저를 사용하며, 같은 텍스트에서도 이전 토크나이저보다 약 30% 더 많은 토큰이 생성될 수 있다고 안내하고 있습니다. 실제 증가량은 콘텐츠와 작업 형태에 따라 달라져요.
이건 꽤 중요한 포인트입니다.
모델을 업그레이드했는데 Claude API 가격의 달러 단가가 비슷하다고 해서 실제 청구액까지 반드시 같다고 볼 수는 없어요.
기존 서비스를 새 모델로 옮긴다면 과거 토큰 사용량을 그대로 대입하기보다 실제 요청을 몇 번 돌려보고 다시 측정하는 편이 안전합니다.
Claude Pro를 결제하면 API도 무료일까요?
이 질문도 정말 많이 헷갈려 해요.
Claude Pro나 Max를 사용하고 있다면
“이미 구독료를 내고 있는데 API도 포함되는 것 아닌가?”
라고 생각하기 쉽습니다.
하지만 Anthropic은 Claude 유료 구독과 Claude Console의 API를 별도의 제품으로 운영하고 있어요.
Pro, Max, Team, Enterprise 같은 유료 플랜을 이용하고 있더라도 Claude Console을 통한 API 사용량은 자동으로 포함되지 않습니다. API를 이용해 애플리케이션이나 서비스를 개발한다면 별도로 Console을 설정하고 API 사용료를 지불해야 해요.
다만 Claude Code처럼 구독 플랜으로 사용할 수 있는 기능도 있기 때문에
“Claude를 코딩에 사용한다”
와
“Claude API 키를 이용해 직접 호출한다”
를 같은 것으로 생각하면 헷갈릴 수 있습니다.
이번 글에서 계산하는 Claude API 가격은 Claude 웹이나 앱의 월 구독료가 아니라 개발자가 Claude API를 호출했을 때 발생하는 사용량 기반 비용이라는 점을 구분해두면 좋아요.
토큰 단가보다 ‘작업 한 건의 원가’를 계산해보세요
2026년 9월 30일 기준으로 Claude Opus 5.5는 입력 100만 토큰당 4달러, 출력 20달러이고 Sonnet 5.5는 입력 2달러, 출력 10달러예요.
Haiku 4.5는 입력 1달러와 출력 5달러입니다.
표만 보면 Haiku가 가장 저렴하고 Opus가 가장 비쌉니다.
하지만 실제 서비스에서는 모델의 성능, 재시도 횟수, 평균 출력 길이, Prompt Caching, Batch 처리 가능 여부까지 함께 봐야 해요.
특히 반복되는 긴 문맥이 있다면 캐시가 비용 구조를 바꿀 수 있고, 실시간 응답이 필요 없는 작업이라면 Batch API를 통해 기본 입력·출력 비용을 절반 수준으로 낮출 수도 있습니다.
결국 제가 Claude API 가격을 비교하면서 가장 중요하게 보는 것은
“100만 토큰이 몇 달러인가?”
에서 한 단계 더 나아간 숫자예요.
“내가 원하는 작업 하나를 성공적으로 끝내는 데 실제로 얼마가 드는가?”
이 기준으로 모델을 비교하면 단순히 가장 싸거나 가장 비싼 모델을 고르는 것보다 훨씬 현실적인 선택을 할 수 있습니다.
API 가격과 모델 정책은 변경될 수 있으니 실제 서비스에 적용하기 전에는 Anthropic 공식 가격 페이지를 다시 확인해주세요.
가격 확인 기준일 : 2026년 9월 30일
참고한 공식 자료
Claude 모델별 비용을 확인했다면 다음은 Gemini를 비교해볼 차례예요. 특히 Gemini 3.8 Flash는 2026년 특별 가격과 2027년 이후 가격이 달라 장기 운영비를 따로 계산해볼 필요가 있습니다.
→ 2026 Gemini API 가격 비교 : Gemini 모델별 100만 토큰 비용은 얼마일까?
2026 Gemini API 가격 비교 : Gemini 모델별 100만 토큰 비용은 얼마일까?
지난 글에서는 GPT·Claude·Gemini·DeepSeek의 대표 모델을 같은 기준으로 놓고 전체적인 API 비용을 비교해봤어요. 네 회사의 가격 차이를 먼저 보고 싶다면 아래 글을 참고해보세요.→ 2026년 하반기 AI
shai-devit.tistory.com
Claude뿐 아니라 OpenAI 모델별 가격 차이가 궁금하다면 GPT-6 Astra·Sol·Luna의 입력·출력 비용을 따로 정리한 글도 함께 참고해보세요.
→ 2026 OpenAI API 가격 비교 : OpenAI 모델별 100만 토큰 비용은 얼마일까?
2026 OpenAI API 가격 비교 : OpenAI 모델별 100만 토큰 비용은 얼마일까?
Shai | Harness Developer같은 OpenAI인데 비용 차이가 이렇게 클까?지난 글에서 GPT·Claude·Gemini·DeepSeek 네 회사의 API 가격표를 직접 같은 기준으로 맞춰봤어요. → GPT·Claude·Gemini·DeepSeek 네 회사의 API 가
shai-devit.tistory.com
'AI서비스' 카테고리의 다른 글
| 2026 AI API 가성비 비교 : GPT·Claude·Gemini·DeepSeek, 같은 성능이면 어디가 가장 저렴할까? (0) | 2026.10.03 |
|---|---|
| 2026 DeepSeek API 가격 비교 : DeepSeek 모델별 100만 토큰 비용은 얼마일까? (0) | 2026.10.02 |
| 2026 Gemini API 가격 비교 : Gemini 모델별 100만 토큰 비용은 얼마일까? (0) | 2026.10.01 |
| 2026 OpenAI API 가격 비교 : OpenAI 모델별 100만 토큰 비용은 얼마일까? (0) | 2026.09.29 |
| 2026년 하반기 AI API 가격 비교 : GPT·Claude·Gemini·DeepSeek 100만 토큰 비용 총정리 (0) | 2026.09.29 |