뉴스 / 모델 워치
API 빌더를 위한 DeepSeek-V4-Pro: V3.2를 대체한 모델
프롬프트나 대시보드에 DeepSeek-V3.2가 여전히 “현재” 범용 모델로 설정되어 있다면 업데이트하세요. 이제 프로덕션 플래그십 라인업은 V4입니다.
V4-Pro 정식 버전(GA)이 DeepSeek-V4-Pro-0813으로 공식 출시되었습니다. DeepSeek 공식 API 문서에서 2026-08-13에 deepseek-v4-pro를 0813 스냅샷으로 업데이트했습니다. 동일한 모델 ID에 에이전트 역량이 강화되었으며, 8/16부터 피크/오프피크 요금제가 적용됩니다(피크 = 오프피크 요금의 2배, V4-Pro 출력 기준 최대 $3.96/M). 본 가이드(2026-07-27 작성) 내용은 여전히 유효하며, 전체 릴리스 요약은 DeepSeek-V4-Pro-0813 Official Release에서 확인하실 수 있습니다.
DeepSeek-V4-Pro (~1.6T MoE / 49B 활성, 1M 컨텍스트)는 고품질 티어이며, V4-Flash는 대용량 처리 티어입니다. 대표적인 API ID: deepseek-v4-pro, deepseek-v4-flash. 순수 추론 작업에는 여전히 DeepSeek-R1이 적합합니다.
GPT-5.6 Sol / Claude Opus 5 대비 주목해야 하는 이유
미국의 폐쇄형 플래그십 모델들이 여전히 많은 벤치마크 리더보드를 선점하고 있지만, V4-Pro는 에이전틱 코딩 가성비 및 자체 호스팅 옵션 측면에서 지속적으로 선택받고 있습니다. ChinaModelAPI 사용자에게 실질적인 이점은 동일한 OpenAI SDK 사용, 더 저렴한 토큰 비용, 향후 온프레미스 구축 옵션입니다.
마이그레이션 체크리스트
- 모델 문자열 변경 →
deepseek-v4-pro(또는 flash) - 20–50개 프롬프트 평가 세트 재실행 (마케팅 문구만 맹신하지 마세요)
- 프로덕트 코드에서 최대 컨텍스트 제한 — 1M은 강력하지만 비용이 많이 듭니다
- 고난도 추론 라우팅에만 R1 유지
from openai import OpenAI
client = OpenAI(api_key="...", base_url="https://api.chinamodelapi.com/v1")
client.chat.completions.create(model="deepseek-v4-pro", messages=[...])
관련 콘텐츠
FAQ
V3.2는 지원 중단(deprecated)되었나요?
V4를 기본 플래그십 모델로 간주하세요. 마이그레이션 전환 기간 동안 기존 레거시 ID가 계속 작동할 수 있으니 대시보드에서 확인하시기 바랍니다.
Pro vs Flash?
고품질 에이전트/코딩 작업에는 Pro, 대용량 QPS의 저비용 작업에는 Flash.