
DeepSeek API 요금 개요
DeepSeek이 API 가격 체계를 전면 개편했습니다. 공식 문서에 적힌 적용 시점은 2026년 8월 16일 16:00 UTC, 한국시간으로는 2026년 8월 17일 01:00 KST입니다. 로이터와 Caixin이 적용일을 "8월 17일"로 보도한 건 베이징시간 표기여서 공식 문서와 어긋나지 않습니다. 다만 영문 문서의 "8월 16일"만 읽으면 하루 일찍 오해할 수 있으니, 국내 개발자는 KST 8월 17일 새벽 1시를 기준으로 잡아야 합니다.
이번 개편은 단순 인상이 아닙니다. 기존 단일 정액제를 폐지하고 피크/오프피크 이원 요금제를 도입한 것이 구조적 변화입니다. 공식 체인지로그(2026-08-13)는 오프피크 가격을 피크 가격의 절반으로 설정한다고 명시했습니다. 문제는 그 "절반"이 인하가 아니라는 데 있습니다. 기준선 자체가 피크로 새로 세워졌으니 오프피크 요율조차 종전 가격보다 비쌉니다.
로이터는 인상폭을 "현재가 대비 50%에서 1,100%"로 보도했고, 이 범위는 공식 요율표에서 그대로 재현됩니다. 지난 2년간 중국 AI 업계를 지배해온 가격 인하 경쟁이 처음으로 뒤집힌 사건이라, 한 회사의 가격 조정 이상의 의미가 있습니다. DeepSeek이 바로 그 가격 전쟁을 촉발한 당사자였기 때문입니다.
1. 인상 전후 요율 전체 비교표 (2026년 8월 16일 공식 문서 기준)
먼저 숫자부터 보겠습니다. 아래는 DeepSeek 공식 가격 페이지에 게시된 100만 토큰당 USD 단가로, 2026년 8월 16일 확인 시점 기준입니다.
| 모델 / 구분 | 캐시적중 입력 | 캐시미스 입력 | 출력 |
|---|---|---|---|
| v4-flash (구가격) | $0.0028 | $0.14 | $0.28 |
| v4-flash 오프피크 | $0.007 | $0.22 | $0.66 |
| v4-flash 피크 | $0.014 | $0.44 | $1.32 |
| v4-pro (구가격) | $0.003625 | $0.435 | $0.87 |
| v4-pro 오프피크 | $0.022 | $0.66 | $1.98 |
| v4-pro 피크 | $0.044 | $1.32 | $3.96 |
위안화 표기 원문도 같은 구조입니다. v4-pro는 변경 전 0.025元 / 3元 / 6元에서, 오프피크 0.15元 / 4.5元 / 13.5元, 피크 0.30元 / 9元 / 27元으로 조정됐습니다. 영문판과 중문판 요율이 UTC+8 환산 기준으로 일치하니, 어느 한쪽의 표기 오류일 가능성은 없습니다.
인상 배수를 직접 계산해보면 편차가 극단적입니다. 최대는 v4-pro 캐시적중 입력의 피크 기준 12.14배(+1113.8%), 최소는 v4-pro 캐시미스 입력의 오프피크 기준 1.52배(+51.7%)입니다. 로이터가 전한 "50%~1,100%" 범위가 정확히 이 두 극단에서 나왔습니다.
출력 토큰만 떼어보면 흐름이 더 뚜렷합니다. v4-flash 출력은 $0.28에서 오프피크 $0.66(2.36배), 피크 $1.32(4.71배)로 올랐습니다. v4-pro 출력은 $0.87에서 오프피크 $1.98(2.28배), 피크 $3.96(4.55배)입니다. 두 모델 모두 출력 기준 오프피크 약 2.3배, 피크 약 4.6배로 배수가 일관됩니다.
2. 피크 시간대가 한국 근무시간과 정확히 겹치는 문제
DeepSeek이 내놓은 절감 방안은 "오프피크로 작업을 옮기라"입니다. 공식 성명은 자원을 합리적으로 배분하려 피크/오프피크 요금제를 채택하며, 이용자가 실제 사용 패턴에 맞춰 작업을 스케줄링하도록 유도한다는 취지를 밝혔습니다. 문제는 그 피크 구간이 어디에 놓여 있느냐입니다.
| 구분 | UTC | 베이징시간(CST) | 한국시간(KST) |
|---|---|---|---|
| 피크 1구간 | 01:00–04:00 | 09:00–12:00 | 10:00–13:00 |
| 피크 2구간 | 06:00–10:00 | 14:00–18:00 | 15:00–19:00 |
| 오프피크 | 나머지 전 시간 | 나머지 전 시간 | 나머지 전 시간 |
피크는 하루 7시간, 나머지 17시간이 오프피크입니다. 산술적으로는 오프피크가 훨씬 길어 유리해 보입니다. 그러나 이 7시간은 베이징 업무시간을 그대로 옮겨놓은 구간이며, 한국시간으로 환산해도 오전 10시부터 오후 1시, 오후 3시부터 7시입니다. 한국 직장인의 업무 집중 시간대와 거의 완전히 포개집니다.
뜻하는 바는 분명합니다. 한국 사용자에게 "오프피크로 옮기기"는 야간·새벽 배치 작업으로만 가능한 전략입니다. 사내 챗봇, 고객 응대 자동화, 실시간 코드 어시스턴트처럼 사람이 기다리는 경로에서는 오프피크 요율을 취할 방법이 사실상 없습니다. 대화형·실시간 서비스는 피크 요율 고정을 전제로 예산을 다시 잡아야 합니다.
반대로 절감 여지가 확실한 워크로드도 있습니다. CI 파이프라인의 자동 코드리뷰, 야간 문서 인덱싱, 대량 데이터 라벨링, 정기 리포트 생성처럼 응답 지연이 문제되지 않는 비동기 작업은 KST 심야에서 새벽 사이로 밀면 정확히 절반 값을 얻습니다. 결국 이번 개편은 요금 인상인 동시에 워크로드를 동기·비동기로 분리하도록 강제하는 압력으로 작동합니다.
3. 헤드라인에 안 나온 진짜 타격점 — 캐시 할인율 축소
"출력 4.5배"라는 헤드라인보다 실무에 더 아픈 변화가 따로 있습니다. 프롬프트 캐싱 할인율이 조용히 축소됐다는 점입니다. 공식 발표문은 캐시 정책 변화를 따로 강조하지 않았지만, 요율표를 나눠보면 드러납니다.
| 모델 | 캐시적중가 ÷ 캐시미스가 | 캐시 절감률 |
|---|---|---|
| v4-pro 구가격 | 0.83% | 99.2% 절감 |
| v4-pro 신가격 | 3.33% | 96.7% 절감 |
절감률이 99.2%에서 96.7%로 내려간 것은 언뜻 2.5%p 차이로 보이지만, 캐시적중분에 실제로 부과되는 금액은 4배로 뜁니다. 긴 시스템 프롬프트와 도구 정의를 캐시에 태워 비용을 눌러온 에이전트 파이프라인일수록 체감 인상폭이 커집니다. 캐싱을 전제로 아키텍처를 설계한 팀이 이번 개편의 최대 피해자입니다.
에이전트형 코딩 세션 1회를 캐시적중 입력 90만 + 캐시미스 입력 10만 + 출력 5만 토큰으로 가정하고 위 공식 단가로 계산하면 이렇습니다.
| 구성 | 요청 1회 비용 | 구가격 대비 |
|---|---|---|
| v4-flash 구가격 | $0.0305 | 기준 |
| v4-flash 오프피크 | $0.0613 | 2.01배 |
| v4-flash 피크 | $0.1226 | 4.02배 |
| v4-pro 구가격 | $0.0903 | 기준 |
| v4-pro 오프피크 | $0.1848 | 2.05배 |
| v4-pro 피크 | $0.3696 | 4.09배 |
주의할 점은 이 배수가 캐시적중률 90%라는 가정에 종속된 값이라는 것입니다. 캐시 활용도가 낮은 워크로드는 인상폭이 완만하고, 캐시 의존도가 높을수록 배수가 커집니다. 실제 청구액을 예측하려면 자사 로그에서 캐시적중률과 출력 토큰 비율을 뽑아 직접 재계산해야 합니다. 남의 배수를 그대로 가져다 쓰면 예산이 어긋납니다.
4. 경쟁 모델과의 손익분기 — GPT-5.6 Luna가 역전한 지점
가격이 오르면 대안을 봐야 합니다. 아래는 2026년 8월 16일 각 사 공식 문서에서 확인한 100만 토큰당 USD 단가입니다.
| 모델 | 캐시적중 입력 | 캐시미스 입력 | 출력 |
|---|---|---|---|
| DeepSeek v4-flash (오프피크) | $0.007 | $0.22 | $0.66 |
| DeepSeek v4-pro (오프피크) | $0.022 | $0.66 | $1.98 |
| DeepSeek v4-pro (피크) | $0.044 | $1.32 | $3.96 |
| OpenAI GPT-5.6 Luna | $0.02 | $0.20 | $1.20 |
| Z.ai GLM-5.2 | $0.26 | $1.40 | $4.40 |
| OpenAI GPT-5.6 Terra | $0.20 | $2.00 | $12.00 |
| Moonshot Kimi K3 | $0.30 | $3.00 | $15.00 |
앞서의 동일 워크로드(캐시적중 90만 + 캐시미스 10만 + 출력 5만)로 환산하면 순위가 이렇게 정리됩니다.
| 모델 | 요청 1회 비용 |
|---|---|
| v4-flash 오프피크 | $0.0613 (최저) |
| v4-flash 피크 | $0.1226 |
| v4-pro 오프피크 | $0.1848 |
| GPT-5.6 Luna | $0.0980 |
| v4-pro 피크 | $0.3696 |
| GLM-5.2 | $0.5940 |
| GPT-5.6 Terra | $0.9800 |
| Kimi K3 | $1.3200 |
여기서 가장 중요한 사실은 GPT-5.6 Luna($0.098)가 v4-pro 오프피크($0.185)보다 싸졌다는 점입니다. 인상 전 v4-pro는 같은 워크로드에서 $0.0903으로 Luna보다 저렴했습니다. 이번 인상이 뒤집은 지점이 정확히 여기입니다. 가장 값싼 오프피크 시간대를 잡아도 v4-pro는 더 이상 Luna보다 싸지 않습니다.
성능도 함께 봐야 합니다. Artificial Analysis Intelligence Index v4.1.1 기준 DeepSeek V4 Pro 0813(max)은 53점이며, 같은 지표에서 Z.ai GLM-5.2도 동일한 53점으로 보고됐습니다. 다만 GLM-5.2는 같은 워크로드에서 v4-pro 피크의 약 1.6배 비용입니다. 점수가 같다면 오프피크 시간대의 DeepSeek이 여전히 유리하고, 피크 시간대라면 격차가 크게 줄어듭니다.
한편 v4-flash 오프피크는 여전히 이 표에서 최저가입니다. 그리고 flash와 pro의 AA 지능 지수 차이는 4월 프리뷰 측정 기준 5점(47 vs 52), 8월 0813 기준으로는 1점 차에 불과합니다. 따라서 pro 워크로드를 flash로 내리는 편이 프로바이더를 통째로 바꾸는 것보다 마이그레이션 비용이 작습니다. 대안 검토의 첫 카드는 타사 이전이 아니라 사내 모델 다운그레이드여야 합니다.
5. 단가만 보면 놓치는 것들 — 환각률·토큰 소모량·미확인 항목
재시도 비용이 함께 오른다
독립 평가에서 확인된 불편한 수치가 있습니다. Artificial Analysis는 V4 Pro의 환각률을 94%, V4 Flash를 96%로 보고했습니다. 모르는 것을 모른다고 하지 않고 답을 만들어내는 성향이 그만큼 강합니다. 토큰이 헐값이던 시절에는 "틀리면 다시 시키면 된다"로 덮을 수 있었지만, 단가가 2~5배 오르면 재시도 자체가 비용입니다. 검증 루프를 붙이면 그 검증 호출에도 인상된 요율이 적용됩니다.
소모 토큰량이 단가 차이를 뒤집을 수 있다
AA 측정에 따르면 V4 Pro는 인덱스 1회 완주에 출력 토큰 130M을 소모했고(4월 리뷰 시점에는 190M), AA는 이를 토큰 소모가 큰 모델군으로 분류했습니다. 실제 청구액은 단가가 아니라 단가 × 토큰량입니다. 단가표만 나란히 놓고 비교하면 DeepSeek의 비용 우위가 과대평가됩니다. Hacker News에서도 "토큰 단가만으로는 비용을 못 본다, 캐싱 전략과 작업당 평균 토큰 수가 실제 청구액을 좌우한다"는 지적이 나왔는데, 이는 커뮤니티 의견이며 공식 확인 자료가 아닙니다.
사용량 1위의 실체
2026년 7월 27일부터 8월 2일까지 OpenRouter 주간 모델 사용량 랭킹에서 V4 Flash가 7.22조 토큰으로 1위를 기록했습니다. 8월 1일 하루 OpenCode에서만 8조 토큰이 처리됐는데, 그중 5조가 무료 체험분이고 3조가 유료였습니다. 사용량 지표의 62%가 무료 트래픽이었다는 뜻입니다. 이번 인상은 그 무료·저가 구조를 정리하는 조치로 읽는 편이 정합적입니다.
아직 확인되지 않은 것들
정직하게 밝혀둘 미확인 항목이 있습니다.
- 소급 적용 여부 — 이미 결제·소비된 토큰이나 선충전 잔액 처리 방침이 공식 문서에서 확인되지 않았습니다(확인 필요 — 공식 자료 미확인). 커뮤니티에서 반복된 질문이지만 공식 답변을 찾지 못했습니다.
- 무료 티어 정책 변경 여부 — 무료 트래픽 비중이 컸음에도, 이번 개편에서 무료 정책이 어떻게 바뀌는지는 공식 문서에 없습니다(확인 필요 — 공식 자료 미확인).
- reasoning effort 3단계별 과금 — GA 발표는 low / high / max 3단계 도입을 명시했으나, 단계별로 출력 단가가 같은지 추론 토큰이 별도 계산되는지는 확인되지 않았습니다(확인 필요 — 공식 자료 미확인).
- Vals AI 평가 수치 — 직접 조회값과 언론 인용값, 검색 스니펫값이 서로 다릅니다. 어느 값도 신뢰해 인용하기 어려워 이 글에서는 제외했습니다.
- 가격 재조정 가능성 — 공식 가격 페이지에는 여전히 가격 조정 권리를 보유한다는 문구가 남아 있습니다. 이번이 마지막 조정이라는 약속은 어디에도 없습니다.
참고로 함께 확인된 사양
DeepSeek-V4-Pro는 2026년 8월 13일 정식 출시(GA)됐고 APP·웹·API에 동시 배포됐습니다. 모델명은 로 유지되며, 현재 서빙 버전은 V4-Flash-0731과 V4-Pro-0813입니다. 두 모델 모두 컨텍스트 1M 토큰, 최대 출력 384K 토큰을 지원하고, GA와 함께 OpenAI Responses API 네이티브 지원이 추가됐습니다. Kimi K3를 컨텍스트 길이만으로 선택할 이유는 사라진 셈입니다.
정리
DeepSeek은 2026년 8월 17일 01:00 KST부터 피크/오프피크 이원 요금제를 적용했고, 항목별 인상폭은 최소 1.52배에서 최대 12.14배에 이릅니다. "오프피크는 절반"이라는 표현은 할인처럼 들리지만 기준선이 새로 세워진 결과일 뿐, 오프피크 요율도 종전보다 2배 이상 비쌉니다.
실무에서 가장 아픈 지점은 출력 단가가 아니라 캐시 절감률의 99.2% → 96.7% 후퇴이며, 캐싱 최적화된 에이전트 파이프라인일수록 타격이 큽니다. 게다가 피크 시간대(KST 10~13시, 15~19시)가 한국 근무시간과 겹쳐, 실시간 서비스는 절감 전략을 쓸 수 없습니다.
대응 순서는 명확합니다. 첫째, 비동기 배치를 KST 심야로 이전하고, 둘째, pro 워크로드의 flash 다운그레이드를 검토하며, 셋째, GPT-5.6 Luna와의 역전 구간을 자사 워크로드로 재계산하는 것입니다. V4 계열은 오픈웨이트 모델이라 제3자 추론 사업자나 자체 호스팅이라는 협상 카드가 남아 있는데, 폐쇄형 모델 사용자에게는 없는 선택지입니다.
함께 보면 좋은 글
참고 자료
조사 기준일: 2026년 08월 16일
본문의 수치는 아래 자료에서 확인한 것입니다. 제조사 공식 자료(T1)와 전문 매체 실측(T2)을 구분해 표기했습니다. 가격·공급 상황은 변동이 크므로 기준일 이후의 값은 다시 확인해야 합니다.
Tier 1 (원문 직접 대조, 2026-08-16 확인)
- DeepSeek API Docs — Models & Pricing (영문): https://api-docs.deepseek.com/quick_start/pricing/
- DeepSeek API Docs — 모델 및 가격 (중문, 위안화 요율 교차검증): https://api-docs.deepseek.com/zh-cn/quick_start/pricing/
- DeepSeek API Docs — Change Log (2026-08-13 / 2026-07-31 항목): https://api-docs.deepseek.com/updates/
- DeepSeek API Docs — News: DeepSeek-V4-Pro GA Release (2026-08-13): https://api-docs.deepseek.com/news/news260813/
- DeepSeek API Docs — News: DeepSeek V4 Preview Release (2026-04-24, 파라미터 수 출처): https://api-docs.deepseek.com/news/news260424/
- Z.ai Docs — Pricing (GLM-5.2 요율): https://docs.z.ai/guides/overview/pricing
- Moonshot / Kimi Platform — Kimi K3 Pricing: https://platform.kimi.ai/docs/pricing/chat-k3
- OpenAI Developers — API Pricing (GPT-5.6 Sol/Terra/Luna): https://developers.openai.com/api/docs/pricing
Tier 2 (독립 검증·취재, 2026-08-16 확인)
- Artificial Analysis — DeepSeek V4 Pro 0813 (max) 모델 페이지: https://artificialanalysis.ai/models/deepseek-v4-pro
- Artificial Analysis — "DeepSeek is back among the leading open weights models with V4 Pro and V4 Flash": https://artificialanalysis.ai/articles/deepseek-is-back-among-the-leading-open-weights-models-with-v4-pro-and-v4-flash
- Vals AI — DeepSeek V4 Pro 모델 페이지 (수치 상충, 인용 보류): https://www.vals.ai/models/deepseek_deepseek-v4-pro
- Reuters (Yahoo Finance 재게재), "DeepSeek raises API pricing for its V4 models", 2026-08-13: https://finance.yahoo.com/technology/ai/articles/deepseek-raises-api-pricing-v4-115712902.html
- Caixin Global, "DeepSeek Launches V4-Pro and Raises API Prices by as Much as 1,100%", 2026-08-14: https://www.caixinglobal.com/2026-08-14/deepseek-launches-v4-pro-and-raises-api-prices-by-as-much-as-1100-102473919.html
- TechNode, "DeepSeek Plans Significant API Price Increases", 2026-08-06: https://technode.com/2026/08/06/deepseek-plans-significant-api-price-increases/
- TechNode, "DeepSeek V4 Flash tops OpenRouter weekly ranking with 7.22 trillion tokens", 2026-08-05: https://technode.com/2026/08/05/deepseek-v4-flash-tops-openrouter-weekly-ranking-with-7-22-trillion-tokens/
- South China Morning Post, "DeepSeek's updated V4 Pro AI model struggles on benchmarks, shines in cybersecurity": https://www.scmp.com/tech/big-tech/article/3363895/deepseeks-updated-v4-pro-ai-model-struggles-benchmarks-shines-cybersecurity
- PYMNTS, "DeepSeek Introduces Peak-Hour Pricing That Quadruples Current Levels": https://www.pymnts.com/news/artificial-intelligence/2026/deepseek-introduces-peak-hour-pricing-that-quadruples-current-levels/
- Bloomberg, "DeepSeek Plans 'Significant' Price Increase for AI Services", 2026-08-06 (제목·요지만 확인, 페이월): https://www.bloomberg.com/news/articles/2026-08-06/deepseek-plans-significant-price-increase-for-its-ai-services
Tier 3 (커뮤니티 — 수치 근거 아님)
- Hacker News, "DeepSeek up to 1000% price hike is live" (2026-08-13, 25pt): https://news.ycombinator.com/item?id=49287881
- Hacker News, "DeepSeek warns of a 'significant' price rise" (2026-08-06, 8pt): https://news.ycombinator.com/item?id=49196356
- Hacker News, "DeepSeek v4 Price Increase" (2026-08-13, 11pt): https://news.ycombinator.com/item?id=49285741
- HN Algolia 검색 (2026-08-06 중복 제출 스토리 6건 확인): https://hn.algolia.com/api/v1/search?query=DeepSeek%20price&tags=story
접근 실패 (미대조)
- x.com/deepseek_ai 공식 가격 공지 (HTTP 402)
- qz.com 기사 (HTTP 403)
- www.reddit.com r/LocalLLaMA 검색 (도구 차단)
'가격·시장' 카테고리의 다른 글
| GPT-5.6 Luna 80% 인하 vs Gemini 3.7 Flash 도입가 — 2026년 8월 AI API 단가 재계산 실무 가이드 (0) | 2026.08.18 |
|---|---|
| GPU 가격 동향 2026, 구매 시기 판단 기준 총정리 (0) | 2026.08.16 |
| RTX PRO 2000 Blackwell 가격 인상 영향과 국내 유통가 격차 정리 (0) | 2026.08.15 |
| H100 H200 클라우드 시간당 요금 2026 총정리: 왜 아직 안 싸지는가 (0) | 2026.08.14 |
| RTX PRO 5000 벌크 리테일 가격차이, 구매 전 반드시 확인할 점 (0) | 2026.08.05 |