AI 챗봇 API 월 비용

채팅 어시스턴트는 메시지마다 시스템 프롬프트와 지금까지의 대화를 다시 보내므로, 답변은 짧아도 입력이 계속 쌓입니다. 여기서는 대화 1건에 메시지 4개, 메시지마다 입력 1,200 토큰과 출력 400 토큰을 가정하고, 입력의 60%는 캐시된 앞부분(지침, 도움말 문서 일부, 이전 대화), 5%는 캐시 쓰기로 계산했습니다. 사용자가 답을 기다리므로 Batch API는 쓸 수 없습니다.

비용은 트래픽에 정비례합니다. 하루 100,000건의 대화에서 MiMo V2.6 Flash의 비용은 월 $2,175, 대화 1,000건당 약 $0.72입니다. 이 대화당 비용을 상담 티켓 1건의 비용이나 구독 가격과 비교하면 됩니다. 시스템 프롬프트가 길어지거나 검색 문서가 늘면 대화당 한 번이 아니라 모든 메시지마다 입력이 늘어납니다.

표는 이 작업량에서 가장 저렴한 현행 모델입니다. 계산기에서 수치를 바꾸거나 구독자당 마진을 확인해 보세요.

모델하루 대화 1,000건
하루 4,000건 · 입력 1,200 · 출력 400 · 캐시 60%
내 수치로 계산하기 →
하루 대화 10,000건
하루 40,000건 · 입력 1,200 · 출력 400 · 캐시 60%
내 수치로 계산하기 →
하루 대화 100,000건
하루 400,000건 · 입력 1,200 · 출력 400 · 캐시 60%
내 수치로 계산하기 →
MiMo V2.6 Flash$21.75/월$217/월$2,175/월
Claude Haiku 5.5$30.80/월$308/월$3,080/월
GPT-6 Luna$30.80/월$308/월$3,080/월
Qwen3.8 Flash$32.94/월$329/월$3,294/월
GLM-5.3 Flash$35.23/월$352/월$3,523/월
Mistral Small (latest)$38.74/월$387/월$3,874/월

공개된 토큰 단가 기반 추정치입니다. 예산을 세우기 전에 공식 가격을 확인하세요. LiteLLM 가격 목록 동기화 2026-10-08.

자주 묻는 질문

채팅 메시지 1개는 몇 토큰인가요?

짧은 질문과 답은 수백 토큰이지만, 요청에는 시스템 프롬프트, 검색한 도움말 문서, 이전 대화도 함께 실립니다. 실제 트래픽 하루치에 대해 API가 돌려주는 사용량을 기록하고 평균값을 계산기에 넣어 보세요.

챗봇 API 비용을 줄이려면?

시스템 프롬프트와 도구 정의를 고정해 맨 앞에 두면 캐시됩니다. 오래된 대화는 줄이거나 요약하고, 쉬운 질문은 작은 모델로 보내고 어려운 질문만 큰 모델로 넘기세요.