OpenAI API 비용 계산기

OpenAI는 반복되는 프롬프트 앞부분을 자동으로 캐시합니다. 요청에 따로 표시할 것이 없고, 아래 모델에서 캐시 적중은 입력 가격의 5%–10%로 청구됩니다. 데이터상 GPT-5.4 mini, GPT-5.4 nano는 캐시 쓰기 요금이 없어 캐시 미스도 일반 입력과 같은 가격이고, GPT-6.1 Sol, GPT-6 Astra, GPT-6 Luna는 입력 단가의 1.25×인 캐시 쓰기 가격이 있습니다. GPT-5.5 Pro는 캐시 입력 가격 자체가 없어 캐싱으로 절약되지 않습니다.

Batch API는 결과를 비동기로 받는 대신 입력을 50%, 출력을 50% 깎아 주며, Batch 안의 캐시 토큰은 일반 캐시 가격의 50%입니다. 롱컨텍스트 요율(GPT-6.1 Sol, GPT-6 Astra, GPT-5.5 Pro, GPT-6 Luna 외 7개 모델 272K 초과 시 입력 2×, 출력 1.5×)은 요청 전체에 적용됩니다. 가장 큰 변수는 모델 등급입니다. pro 모델은 답변마다 연산을 더 쓰고 토큰 단가가 훨씬 높으며, mini와 nano는 품질을 조금 내주고 가격을 낮췄고, 플래그십은 그 중간입니다.

표는 같은 작업량을 모델별로 계산한 것입니다. 하루 10,000건, 요청당 입력 6,000 토큰과 출력 500 토큰입니다. 열은 차례로 캐싱 없음, 입력의 70%를 캐시에서 읽고 5%를 캐시에 쓰는 경우, 모든 요청을 Batch API로 보내는 경우입니다. 같은 트래픽에서 GPT-5.5 Pro의 비용은 GPT-6 Luna의 318배입니다.

모델기본
하루 10,000건 · 입력 6,000 · 출력 500
내 수치로 계산하기 →
프롬프트 캐싱 적용
하루 10,000건 · 입력 6,000 · 출력 500 · 캐시 70%
내 수치로 계산하기 →
Batch API
하루 10,000건 · 입력 6,000 · 출력 500 · batch
내 수치로 계산하기 →
GPT-6.1 Sol$5,100/월$2,751/월$2,550/월
GPT-6 Astra$25,500/월$14,385/월$12,750/월
GPT-5.5 Pro$81,000/월$81,000/월
캐싱 미지원
$40,500/월
GPT-6 Luna$255/월$144/월$128/월
GPT-5.4 mini$2,025/월$1,174/월$1,012/월
GPT-5.4 nano$548/월$321/월$274/월

공개된 토큰 단가 기반 추정치입니다. 예산을 세우기 전에 공식 가격을 확인하세요. LiteLLM 가격 목록 동기화 2026-10-08.

내 트래픽에서 캐시가 언제 이득인지 계산해 보세요: 프롬프트 캐싱 계산기 →

자주 묻는 질문

OpenAI 프롬프트 캐싱을 쓰려면 코드를 바꿔야 하나요?

아닙니다. 프롬프트가 일정 길이를 넘으면 자동으로 캐시됩니다. 고정 내용(지침, 도구 정의, 예시)은 앞에, 바뀌는 내용은 뒤에 두어 요청 사이에 앞부분이 일치하게 하세요.

pro 모델은 언제 쓸 만한가요?

틀린 답의 손해가 추가 토큰 비용보다 클 때입니다. 어려운 추론, 중요한 검토, 적은 호출량이 그런 경우입니다. 데이터상 pro 모델에는 캐시 입력 가격이 없어, 호출이 많은 서비스는 매 요청마다 입력 가격을 그대로 냅니다.

mini와 nano 중 무엇을 써야 하나요?

nano는 대량의 분류, 추출, 라우팅에 맞고, mini는 대화와 간단한 추론을 처리합니다. 내 프롬프트로 둘 다 시험해 보세요. 더 싼 모델이라도 재시도나 더 긴 프롬프트가 필요하면 결국 더 비쌀 수 있습니다.