대규모 문서 분석이나 장문 리포트 생성, 코드베이스 변환 등 대량 토큰 연산이 필요한 백엔드 시스템 개발자에게 적합한 플래그십 MoE 모델입니다. 대량의 입출력 워크플로에 적용할 수 있습니다.

운영 전에는 384,000 토큰의 최대 출력 한도와 함께 오프피크 기준 단가 대비 피크 시간대에 입력과 출력이 정확히 2배로 청구되는 조건을 확인해야 합니다. 시간대별 배치 일정 수립이 필수적입니다.

한 줄 결론

100만 토큰 입력과 384K 출력을 지원하며, 피크 2배 할증을 감안하여 배치 작업을 오프피크에 분산하는 구성이 비용 절감에 유리합니다.

바뀐 점

  • 아키텍처 및 버전: 최신 DeepSeek-V4-Pro-0813 버전으로 1.6T 총 파라미터 중 49B가 활성화되는 MoE 구조입니다.
  • 입출력 한도: 1,000,000 토큰 컨텍스트와 384,000 토큰 최대 출력을 지원하며 FIM 코드 완성을 제공합니다.
  • API 호환성: OpenAI 및 Anthropic 표준 엔드포인트와 호환되어 기존 SDK로 연결할 수 있습니다.

가격과 조건

항목 오프피크 단가 (Off-peak) 피크 단가 (Peak, 2배)
표준 입력 가격 (1M 토큰) $0.66 $1.32
표준 출력 가격 (1M 토큰) $1.98 $3.96
캐시 히트 입력 가격 $0.022 $0.044
컨텍스트 윈도우 1,000,000 토큰 1,000,000 토큰
최대 출력 한도 384,000 토큰 384,000 토큰

DeepSeek 입력/출력 단가는 오프피크 기준이고 피크 2배라는 조건이 적용됩니다. 피크 시간대에는 단가가 2배로 청구되므로 호출 시간대 관리가 필요합니다.

공개 평가에서 읽을 것

  • LiveBench (2026-06-25 release): deepseek-v4-pro-0813 버전이 77.44점을 기록했으며, 이전 버전(deepseek-v4-pro)은 71.57점을 기록했습니다.
  • Artificial Analysis Intelligence Index (v4.2 · 2026-09-04): DeepSeek V4 Pro 0813 (Reasoning, Max Effort) 기준 42.11점을 나타냈습니다.
  • GPQA Diamond (Artificial Analysis · GPQA Diamond): DeepSeek V4 Pro 0813 (Reasoning, Max Effort) 92.83%, DeepSeek V4 Pro (Reasoning, High Effort) 90.51%입니다.

DeepSeek · 공개 평가 결과. GPQA Diamond · % correct

도표 크게 보기

평가 버전: Artificial Analysis · GPQA Diamond.

모델·실행 설정 공개 점수
DeepSeek V4 Pro (Reasoning, High Effort) 90.51
DeepSeek V4 Pro (Reasoning, Max Effort) 88.79
DeepSeek V4 Pro (Non-reasoning) 71.72

전체 결과와 평가 조건

같은 평가 안에서 공개된 실행 설정을 구분했습니다. 추론 강도와 평가 버전이 달라지면 점수를 직접 비교하지 않습니다.

도표의 공개 원문

추천하는 사용법

  • 대량의 데이터 변환이나 주간 코드베이스 점검 작업은 트래픽이 낮은 오프피크 시간대로 스케줄링하여 기본 단가로 처리하는 구성을 권장합니다.
  • 컨텍스트 길이가 100만 토큰에 달하더라도 긴 문맥 내 복합 참조 질의의 정확도가 균일하게 보장되는 것은 아니므로, 주요 검색 키워드에 대한 추출 일관성을 사전 검증하는 실험을 권장합니다.

요청 한 건의 비용으로 바꿔 보면

매일 수집한 로그를 다음 날 아침까지 정리하는 작업은 시간대를 옮길 여지가 있습니다. 반면 고객의 질문에 즉시 답해야 하는 서비스는 피크 시간 호출을 피하기 어렵습니다. 두 요청을 같은 월간 평균 단가로 계산하지 말고, 발생 시간별 비중을 나눠 예산을 잡으세요.

DeepSeek-V4-Pro 기준의 아래 계산은 입력 10,000토큰과 청구 대상 출력 1,000토큰을 사용하는 텍스트 요청을 가정한 예시입니다. 실제 사용량을 측정한 결과가 아니며, 캐시가 없는 표준 호출에서 본문의 단가를 곱했습니다. 입력과 출력의 가격이 다르므로 두 항목을 더해 계산합니다.

모델 입력 비용 USD 출력 비용 USD 합계 USD
DeepSeek-V4-Pro 0.0066 0.00198 0.00858

이 요청을 1,000회 처리한다면 DeepSeek-V4-Pro의 예시 합계는 8.58 USD입니다. 재시도, 검색과 도구 사용료, 세금, 멀티모달 입력 비용은 포함하지 않았습니다. 추론 과정이 출력으로 청구되는 제품에서는 화면에 보이는 답변의 길이보다 청구 토큰 수가 많을 수 있습니다. 실제 청구량은 API 사용량 기록을 기준으로 확인하세요.

DeepSeek-V4-Pro의 도입 여부는 이 예시 금액만으로 결정하지 않는 편이 좋습니다. 같은 요청 묶음에서 정확히 완료한 건수와 사람이 다시 처리한 건수를 함께 기록하세요. 단가가 낮아도 재시도가 많으면 최종 작업 비용이 커집니다. 반대로 상위 모델이 수정 횟수를 줄여 준다면 추가 비용을 낼 요청 범위를 구체적으로 정할 수 있습니다. DeepSeek 계산은 오프피크 기준이며 피크에는 표의 입력·출력 금액이 두 배입니다.

출처