뉴스 / 모델 동향 · 공식 출시 + 개발자 가이드
DeepSeek-V4-Flash-Vision-Exp (2026): 공식 출시, 가격 정책 및 복사해서 바로 쓰는 API 빠른 시작
고래 마스코트 티저가 공개된 지 이틀 만에, 그리고 그레이 릴리스 API 목록에 이름이 유출된 지 하루 만에 DeepSeek가 이를 공식 발표했습니다. 실험용 멀티모달 비전 이해 모델인 deepseek-v4-flash-vision-exp가 2026년 8월 21일부로 공식 API에 출시되었습니다. 텍스트 품질은 V4-Flash와 동일한 수준을 유지하며, 멀티모달 에이전트 성능은 "Opus-4.8에 근접"합니다. 가격은 V4-Flash와 동일하며, 새로운 Files API도 함께 출시되었습니다. 본 가이드에서는 출시 타임라인, 서구권 비전 모델과의 요금 비교 분석, 바로 작동하는 빠른 시작 코드, 워크로드별 DeepSeek 모델 라우팅 권장 사항을 다룹니다.
DeepSeek-V4-Flash-Vision-Exp는 2026년 8월 21일에 공식 출시된 DeepSeek 모델이며, 이는 2026-08-21자 API 변경 로그에 명시되어 있습니다.
model='deepseek-v4-flash-vision-exp'로 호출할 수 있으며, Chat Completions, Anthropic 호환 Messages API 및 Responses API를 통해 base64, 외부 URL 또는 새로운 Files API 방식으로 텍스트와 이미지를 전달할 수 있습니다.
공식 가격 페이지에 따르면 V4-Flash와 동일한 요금인 비피크 시간대 100만 입력 토큰당 $0.22(피크 시간대 $0.44)로 책정되어 있으며, 모든 이미지는 최대 384 토큰으로 청구됩니다.
DeepSeek Harness v0.1.1-rc.1에서 기본 지원합니다.
티저 공개부터 공식 출시까지: 72시간의 타임라인
| 공개 시점 | 주요 경과 · 출처 |
|---|---|
| 6월 18일 | DeepSeek 앱/웹에 이미지 비전 기능 적용(제품 전용, API 모델 미제공). X의 연구진: "웹과 앱에서 비전 기능이 정식 서비스됩니다." |
| 8월 3–4일 | 커뮤니티의 발 빠른 대응: WebBrain의 DeepSeek-V4-Flash-Vision-NVFP4 MoonViT 어댑터와 FlyCockpit의 0731-vision이 Hugging Face에 공개됨(자세한 내용은 하단 참조). |
| 8월 19–20일 | DeepSeek의 멀티모달 연구원 Xiaokang Chen이 X에 눈을 뜬 고래 티저("Now, we see you. 👀")를 게시 — TestingCatalog는 이를 곧 출시될 비전 모델과 연관 지어 보도. |
| 8월 20일 | 정확한 모델 ID가 그레이 릴리스로 포착됨: deepseek-v4-flash-vision-exp가 포함된 API 모델 목록 스크린샷이 X(@NFT_Chen)와 DeepSeek Harness 코드에 등장함 — 당시 공식 문서는 아직 업데이트되지 않음. |
| 8월 21일 (저녁 UTC+8) | 공식 출시. 변경 로그에 "DeepSeek-V4-Flash-Vision-Exp Release"(2026-08-21) 항목 추가, 가격 페이지·Vision 가이드·Files API 가이드 오픈, 공식 WeChat 발표(1시간 이내 언론 보도), DeepSeek Harness v0.1.1-rc.1 네이티브 지원 추가. |
편집자 주: 출시 전인 8월 21일 아침에 발행된 본 브리핑의 초기 버전에서는 공식 모델이 존재하지 않는다고 결론지었습니다. 당시에는 정확한 사실이었으나(문서에 항목이 없었고 모델명은 그레이 릴리스 상태에 불과함), 저녁에는 상황이 바뀌었습니다. 당일 기습 공식 출시가 바로 저희가 모든 사실에 날짜와 시간을 명시하는 이유입니다.
공식 문서 기준 출시 내용 상세
- 모델. 실험용 비전 이해 모델이며,
model='deepseek-v4-flash-vision-exp'로 호출합니다. 공식 설명에 따르면 텍스트 품질은 "공식 DeepSeek-V4-Flash와 동일한 수준"이며, 멀티모달 에이전트 성능은 "Opus-4.8에 근접"합니다. V4-Pro에는 비전 기능이 추가되지 않았으며, 현재로서는 Flash 제품군 전용 기능입니다. - 이미지 전송을 위한 3가지 방법. 인라인 Base64
data:URL, 공개 외부 이미지 URL(최대 8,192자, 60초 다운로드 타임아웃), 또는 Files API(1회 업로드 후file_id참조). 세 가지 엔드포인트 모두 지원됩니다: OpenAI 호환 Chat Completions, Anthropic 호환 Messages(Files API 사용 시anthropic-beta: files-api-2025-04-14헤더 필요), Responses. - 이미지 제한. JPEG / PNG / GIF / WebP 지원. 인라인 또는 URL 방식은 이미지당 32 MiB, file_id 방식은 64 MiB까지 가능. 요청당 최대 600장 이미지 지원. 요청 본문 용량 최대 48 MiB(전체 이미지 64 MiB, file_id 이미지 사용 시 200 MiB). 단변/장변 최대 8,192 px(15장 이상 전송 시 4,096 px).
- Files API (신규 별도 출시). purpose=
user_data, 파일당 64 MiB, 사용자당 25 GiB 및 10,000개 파일 한도, 보관 기간 1시간~30일 또는 영구 보관, 파일 확장자가 아닌 실제 콘텐츠를 기반으로 포맷 감지. - 출시 당일 Harness 지원. DeepSeek Harness v0.1.1-rc.1 (공식 계정, 8월 21일 18:22): "DeepSeek 모델 어댑터에 DeepSeek-V4-Flash-Vision-Exp 멀티모달 모델 옵션 추가 및 네이티브 이미지 요청 설정 지원" — 지난주 rc.7/rc.8에서 구축된 이미지 파이프라인에 이제 공식 퍼스트파티 모델이 연동됩니다(rc.7/rc.8 브리핑 참조).
deepseek-v4-flash-vision-exp 가격 정책 (2026): V4-Flash와 동일, 이미지당 최대 384 토큰 제한
deepseek-v4-flash-vision-exp의 요금은 deepseek-v4-flash와 동일합니다: 100만 입력 토큰당 비피크 시간대 $0.22, 피크 시간대 $0.44, 출력 토큰 $0.66/$1.32이며, 모든 이미지는 최대 384 토큰으로 청구됩니다. 피크 시간대는 UTC 01:00–04:00 및 06:00–10:00(베이징 기준 09:00–12:00 및 14:00–18:00)이며, 비피크 요금은 피크 요금의 절반입니다.
| 100만 토큰당 요금 (USD) | 비피크 | 피크 | 참고사항 |
|---|---|---|---|
| 입력 — 캐시 히트 | $0.007 | $0.014 | deepseek-v4-flash와 동일 |
| 입력 — 캐시 미스 | $0.22 | $0.44 | ≈ ¥1.5 / ¥3.0 |
| 출력 | $0.66 | $1.32 | ≈ ¥4.5 / ¥9.0 |
| 이미지 청구 | 추론 전 크기 조정: <~384×384 크기는 확대, 그 이상은 ~800×800 상당 픽셀로 축소 | 이미지당 최대 384 토큰 상한 — 2000×2000 이미지와 5000×5000 이미지의 비용이 동일하며, 다중 이미지 요청 시 각 이미지는 개별적으로 청구됨 | |
출처: 공식 가격 페이지 및 Vision 토큰 사용 가이드 (2026-08-21 확인).
실제 이미지 처리 비용: vision-exp vs 서구권 비전 모델 비교 (2026)
vision-exp에서 최대 크기 이미지 1장의 비용은 피크 시간대 기준 최대 $0.00017(비피크 $0.000084)입니다. 즉, 비피크 시간대에는 약 1,000장의 스크린샷을 $0.09 미만으로 처리할 수 있습니다. 반면 서구권 비전 지원 모델은 해상도에 비례하는 더 많은 토큰 수와 1.7~13.6배 높은 토큰당 단가를 적용하여 이미지를 과금합니다:
| 모델 (2026) | 입력 $/1M | vs vision-exp | 이미지 청구 |
|---|---|---|---|
| deepseek-v4-flash-vision-exp | $0.22 / $0.44 (비피크/피크) | 기준점 | 이미지당 ≤384 토큰, 엄격한 상한선 |
| Gemini 3.7 Flash (intro) | $0.75 | 1.7–3.4× | 해상도 비례, 384 토큰과 같은 공시된 상한 없음 |
| Grok 4.6 | $2.00 | 4.5–9.1× | 해상도에 따라 다름 |
| Claude Sonnet 4.5 | $3.00 | 6.8–13.6× | 일반적인 스크린샷 ≈1,000+ 토큰 → 이미지당 ≈$0.003+ (추정치) |
비교 가격은 Claude Sonnet 4.5, Grok 4.6의 공개 가격 페이지 정가 및 Google이 공시한 Gemini 3.7 Flash 출시 프로모션 가격(Gemini 3.7 브리핑 참조)을 기준으로 합니다. 경쟁사의 이미지 토큰 수는 해상도에 따라 달라지며 추정치입니다. 그럼에도 핵심 구조는 변함없습니다: vision-exp는 동급 최저 수준의 토큰당 단가와 업계 유일의 이미지당 고정 토큰 상한선을 결합했습니다.
deepseek-v4-flash-vision-exp 호출 방법: 빠른 시작 (curl + Python)
API는 OpenAI와 호환되며, 표준 비전 메시지 형식을 https://api.deepseek.com에서 그대로 사용할 수 있습니다. 공개 URL을 통한 이미지 전송 예시:
curl https://api.deepseek.com/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DEEPSEEK_API_KEY" \
-d '{
"model": "deepseek-v4-flash-vision-exp",
"messages": [{
"role": "user",
"content": [
{"type": "text", "text": "Describe the UI bug visible in this screenshot."},
{"type": "image_url",
"image_url": {"url": "https://example.com/screenshot.png"}}
]
}]
}'
공식 OpenAI SDK를 사용한 동일한 Python 호출 — base_url을 DeepSeek으로 지정하고 이미지를 base64로 인라인 전달:
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.deepseek.com")
resp = client.chat.completions.create(
model="deepseek-v4-flash-vision-exp",
messages=[{
"role": "user",
"content": [
{"type": "text", "text": "Summarize this dashboard."},
{"type": "image_url",
"image_url": {"url": "data:image/png;base64,"}},
],
}],
)
print(resp.choices[0].message.content)
- JavaScript/Node:
openainpm 패키지를 사용하여 동일한 구조로 호출 —baseURL과 모델 ID만 변경하면 됩니다. - 반복 스크린샷 처리 (에이전트 루프): Files API(
purpose="user_data")를 통해 1회 업로드한 후 반환된file_id를 참조하세요. 이미지당 최대 64 MiB를 지원하며 매 턴마다 재업로드할 필요가 없습니다. 이는 DeepSeek Harness v0.1.1-rc.1에서 기본으로 사용하는 패턴입니다. - Anthropic 스타일 스택: Messages 엔드포인트도 지원됩니다. Files API 참조 시
anthropic-beta: files-api-2025-04-14헤더가 필요합니다. - 릴레이 또는 게이트웨이 경유:
image_url콘텐츠 블록을 전달하는 모든 OpenAI 호환 프록시는 비전 페이로드를 그대로 전달합니다. 모델 문제를 의심하기 전에 게이트웨이가 멀티파트 콘텐츠 배열을 제대로 전달하는지 확인하세요.
어떤 DeepSeek 모델로 라우팅할 것인가: vision-exp vs v4-flash vs v4-pro
| 워크로드 유형 | 추천 라우팅 | 선택 이유 |
|---|---|---|
| 텍스트 + 에이전트 코딩 루프, 툴 호출, 긴 컨텍스트 | deepseek-v4-flash | 안정적인 GA 정식 모델, 동일한 가격. 순수 텍스트 턴에서 비전 오버헤드를 부담할 이유가 없음 |
| 스크린샷, UI 디버깅, 차트/대시보드 판독, 문서 이미지 | deepseek-v4-flash-vision-exp | Flash 요금 + 이미지당 384 토큰 상한. Opus-4.8급 멀티모달 에이전트 성능. 실험적 모델이므로 모델 ID를 고정(pin)하여 사용 권장 |
| 최고 난도 추론, 최고 품질, 1M 컨텍스트 | deepseek-v4-pro | DeepSeek 최강 성능 모델. 아직 텍스트 전용이므로 이미지 처리 단계에서는 vision-exp와 병용 권장 |
| 오픈 가중치 기반 자체 호스팅 네이티브 비전 | Kimi K3 / Qwen-VL | vision-exp는 API 전용입니다. 오픈 가중치 비전 모델은 Kimi API 가이드를 참고하세요. |
단 하나의 OpenAI 호환 엔드포인트로 중국 비전 지원 모델 통합 이용
ChinaModelAPI는 전 세계 개발자가 구독 없이 USDT/USD1 결제로 단일 OpenAI 호환 API를 통해 DeepSeek, Qwen, GLM, Kimi 등 중국 프론티어 모델을 손쉽게 활용할 수 있도록 지원하는 독립 릴레이 플랫폼입니다. 이번 vision-exp와 같은 신규 모델 출시는 이 플랫폼의 진가가 드러나는 영역입니다: 출시 첫날 즉시 지원, 투명한 토큰당 과금, 그리고 단 한 번의 연동으로 중국 주요 모델 전체를 아우르는 편의성을 제공합니다.
ChinaModelAPI는 DeepSeek와 공식적인 제휴 관계가 없는 독립 릴레이 서비스입니다. 라우팅되는 모델 ID는 출시 전 실제 환경에서 철저히 검증됩니다 — 비전 라우팅 오픈 시 알림을 받으려면 대기자 명단에 등록하세요.
커뮤니티 어댑터의 현재 위치 (그리고 모델명 혼선 정리)
- 모델명 충돌 해결 — DeepSeek 공식 명칭으로 정립. 지난 2주간 "V4-Flash vision"은 커뮤니티 체크포인트를 의미했습니다. 대표적으로 WebBrain의 DeepSeek-V4-Flash-Vision-NVFP4(동결된 V4-Flash + 동결된 Kimi-K2.6 MoonViT + 40.1M 파라미터 학습 프로젝터, 8월 3일)와 FlyCockpit의 0731-vision(8월 4일)이 있었습니다. 이제 공식 모델이 해당 명칭의 주인이 되었으며, 커뮤니티 어댑터가 따라올 수 없는 공식 지원, 공식 문서, Flash 요금제를 제공합니다.
- 커뮤니티 어댑터가 무용지물이 된 것은 아니며, 역할이 재정립되었습니다. 자체 GPU에서 V4-Flash 가중치를 직접 호스팅하며 오프라인/망분리 환경에서 비전 기능을 사용하려는 경우, 여전히 유일한 선택지입니다. 공식 vision-exp는 API 전용이며 비전 가중치는 오픈소스로 공개되지 않았기 때문입니다.
- 그레이 릴리스에서 공식 출시로 이어지는 패턴에 주목할 필요가 있습니다. 이번 사례는 한 달 사이에 문서 업데이트 전에 API 목록이나 코드에 먼저 모습을 드러낸 두 번째 DeepSeek 릴리스입니다(V4-Flash-0731도 동일한 과정을 거쳤습니다). 릴레이 운영자와 도구 개발자에게는 변경 로그를 기다리는 것보다 모델 목록 엔드포인트와 DSH 릴리스 노트를 모니터링하는 것이 훨씬 빠릅니다.
주요 출처
- DeepSeek API 변경 로그 — 2026-08-21자 "DeepSeek-V4-Flash-Vision-Exp Release" 항목
- DeepSeek 공식 요금표 — vision-exp는 V4-Flash와 동일, 피크/비피크 시간대, 동시 요청 수 2,500
- DeepSeek Vision 가이드 — 이미지 입력 방식, 제한 사항, 이미지당 384 토큰 규칙
- DeepSeek Files API 가이드 — 지원 포맷, 파일당 64 MiB, 사용자당 25 GiB & 1만 개 파일
- DeepSeek Harness 공식 WeChat 공중계정 — v0.1.1-rc.1 vision-exp 모델 옵션 및 네이티브 이미지 요청 추가(2026-08-21)
- 아이판얼(ifanr) — 속보: DeepSeek 멀티모달 모델 출시, 고래가 마침내 '천안(天眼)'을 뜨다(2026-08-21, 요금표 스크린샷 포함)
- X — @NFT_Chen: API 목록에 등장한 vision-exp 그레이 릴리스 스크린샷(2026-08-20)
- TestingCatalog — DeepSeek 멀티모달 연구원 Xiaokang Chen의 눈뜬 고래 티저 (8월 19–20일)
- LINUX DO — DeepSeek-V4-Flash-Vision-Exp 공식 출시 발표(2026-08-21, 커뮤니티 최초 논의 및 요금표)
- Hugging Face — WebBrain 커뮤니티 어댑터 (배경: 출시 전 생태계)
자주 묻는 질문 (2026)
vision-exp는 이제 공식 모델인가요?
네, 그렇습니다 — 날짜가 명시된 변경 로그 항목, 실시간 문서, 공식 발표와 함께 2026년 8월 21일에 공식 출시되었습니다. 8월 20일의 "그레이 릴리스" 스크린샷은 단순 루머가 아니라 실제 모델이 배포 준비 중이던 과정이었습니다.
V4-Pro에도 비전 기능이 추가되었나요?
아닙니다. Flash 제품군에만 비전 파생 모델이 추가되었습니다. V4-Pro는 여전히 텍스트 전용이며, Pro급 비전 모델 출시 여부는 아직 발표되지 않았습니다.
이미지 요금은 어떻게 청구되나요?
이미지는 약 800×800 상당 픽셀(최소 약 384×384)로 크기가 조정된 후 토큰으로 변환되어 입력 토큰으로 과금되며, 이미지당 최대 384 토큰으로 제한됩니다. 2K 이미지와 5K 이미지의 처리 비용은 동일합니다.
오픈 가중치도 공개되었나요?
아닙니다. vision-exp는 현재 API 전용입니다. 자체 호스팅 사용자는 비공식 오프라인 대안으로 커뮤니티 어댑터(WebBrain NVFP4, FlyCockpit)를 계속 사용할 수 있으나, 이번 공식 릴리스와 비교 벤치마크된 것은 아닙니다.
OpenRouter나 서드파티 제공업체에서도 이용 가능한가요?
발행 시점(8월 21일 저녁 UTC+8) 기준으로 해당 모델은 DeepSeek 공식 플랫폼에서만 제공되었으며, 서드파티 제공 여부는 아직 확인되지 않았습니다. 라우팅 전에 이용하시는 제공업체의 실시간 모델 목록을 확인하세요.
비디오나 PDF 입력도 지원하나요?
지원하지 않습니다 — 공식 문서에는 이미지 입력(JPEG/PNG/GIF/WebP)만 명시되어 있습니다. 문서의 경우 호출 측에서 페이지를 이미지로 추출해야 하며, 비디오의 경우 프레임을 샘플링하여 전송해야 합니다.
요청 한도(Rate limits)는 어떻게 되나요?
공식 가격 페이지에 따르면 두 Flash 모델의 동시 요청 한도는 2,500회입니다(V4-Pro는 500회). 다만 실험(Experimental) 단계이므로 한도가 변경될 수 있으니 공식 문서를 확인하세요.
프로덕션 환경에 바로 사용할 수 있나요?
"Exp"(실험 버전) 명칭에 유의해야 합니다: 동작 특성 변화, 요금/약관 변경, 또는 지원 중단/모델명 변경(DeepSeek의 기존 전례: preview → 0731 GA) 가능성이 있습니다. 설정 플래그 하나로 바로 전환할 수 있는 네이티브 비전 대안(Kimi K3, Qwen-VL)을 항상 마련해 두는 것이 좋습니다.