딥시크가 최신 고성능 모델 DeepSeek-V4-Pro-0813을 API에 반영했다. 100만 토큰 컨텍스트와 최대 38만4천 토큰 출력, 추론·에이전트 기능을 지원하며 기존 V4 Pro 프리뷰에서 최신 버전으로 업데이트됐다. (DeepSeek API Docs)
V4 Pro 최신 정보 먼저 정리
2026년 8월 13일 딥시크 공식 API 문서에서 확인되는 V4 Pro 정보는 다음과 같다. (DeepSeek API Docs)
항목DeepSeek V4 Pro
| 최신 버전 | DeepSeek-V4-Pro-0813 |
| API 모델명 | deepseek-v4-pro |
| 총 파라미터 | 1.6T |
| 활성 파라미터 | 49B |
| 컨텍스트 길이 | 1M 토큰 |
| 최대 출력 | 384K 토큰 |
| 사고 모드 | Thinking / Non-Thinking 지원 |
| Tool Calls | 지원 |
| Responses API | 지원 |
| Anthropic API | 지원 |
| API 입력 가격 | 캐시 미스 기준 $0.435 / 100만 토큰 |
| API 출력 가격 | $0.87 / 100만 토큰 |
V4 Pro는 총 1.6조 개 파라미터 가운데 490억 개를 활성화하는 MoE(Mixture-of-Experts) 구조다. 딥시크가 4월 공개한 V4 프리뷰부터 100만 토큰 컨텍스트를 지원했으며, 현재 API 문서에는 최신 버전이 DeepSeek-V4-Pro-0813으로 표시되고 있다. (DeepSeek API Docs)
4월 V4 공개와 이번 업데이트는 무엇이 다른가
DeepSeek V4 자체가 처음 등장한 것은 8월이 아니다.
딥시크는 2026년 4월 24일 V4 Preview를 공개하면서 V4-Pro와 V4-Flash 두 모델을 선보였다. 당시 V4-Pro는 1.6T 파라미터, 49B 활성 파라미터 모델로 공개됐고 API와 오픈 웨이트도 함께 제공됐다. (DeepSeek API Docs)
이후 7월 31일에는 V4-Flash가 업데이트됐지만, 딥시크는 당시 V4-Pro API와 웹·앱 모델은 변경되지 않았으며 V4-Pro의 공식 릴리스가 뒤따를 예정이라고 명시했다. (DeepSeek API Docs)
그리고 8월 13일 현재 공식 API 문서에는 V4-Pro 버전이 DeepSeek-V4-Pro-0813으로 변경돼 있다. API에서 사용하는 모델명 자체는 이전과 동일한 deepseek-v4-pro다. 별도로 모델명을 바꿀 필요 없이 기존 호출 방식으로 최신 버전에 접근할 수 있다. (DeepSeek API Docs)
즉, 제목에서 말하는 ‘V4 Pro 출시’는 V4라는 이름이 처음 공개됐다는 의미보다는 V4-Pro 최신 정식 버전이 API에 반영됐다는 의미로 이해하는 편이 정확하다.
DeepSeek V4 Pro에서 눈에 띄는 부분
1. 100만 토큰 컨텍스트
V4 Pro는 1M, 즉 100만 토큰 컨텍스트 길이를 지원한다. 긴 코드베이스나 대규모 문서, 여러 단계에 걸친 에이전트 작업을 하나의 긴 문맥 안에서 처리하는 용도를 고려한 구성이다. (DeepSeek API Docs)
딥시크는 V4에서 장문 처리 효율을 개선하기 위한 새로운 어텐션 구조를 도입했다고 설명한다. 공개된 V4 모델 자료에 따르면 V4-Pro는 V3.2 대비 100만 토큰 환경에서 단일 토큰 추론 연산량과 KV 캐시 부담을 낮추는 데 초점을 맞췄다. (Hugging Face)
2. 최대 출력 384K 토큰
공식 API 문서에 표시된 최대 출력 길이는 384K 토큰이다. 컨텍스트뿐 아니라 출력 한도 역시 상당히 길게 설정됐다. (DeepSeek API Docs)
긴 코드 생성이나 대규모 문서 처리처럼 한 번의 작업에서 출력 규모가 커지는 용도에서 눈여겨볼 만한 부분이다.
3. Thinking과 Non-Thinking 모두 지원
V4 Pro는 사고 과정을 사용하는 Thinking 모드와 Non-Thinking 모드를 모두 제공한다. API에서는 작업 특성에 따라 사고 모드를 선택할 수 있으며, 공식 예제에서는 reasoning_effort 설정도 제공한다. (DeepSeek API Docs)
단순 응답 속도가 중요한 작업과 복잡한 추론이 필요한 작업을 같은 모델에서 구분해 사용할 수 있다는 의미다.
4. 에이전트·개발 도구 연동 강화
현재 V4 Pro는 Tool Calls, Responses API, Anthropic API를 모두 지원한다. OpenAI 형식의 API와 Anthropic 형식의 API도 제공한다. (DeepSeek API Docs)
딥시크 공식 문서는 Claude Code, GitHub Copilot, OpenCode 같은 에이전트·코딩 도구에서 DeepSeek를 백엔드 모델로 연결할 수 있다고 안내하고 있다. (DeepSeek API Docs)
V4 시리즈가 일반 챗봇 응답뿐 아니라 코딩 에이전트와 장시간 작업을 염두에 둔 모델이라는 점이 드러나는 부분이다.
DeepSeek V4 Pro API 가격은 얼마인가
2026년 8월 13일 공식 API 가격 기준은 다음과 같다. (DeepSeek API Docs)
구분V4 ProV4 Flash
| 입력 - 캐시 적중 | $0.003625 / 100만 토큰 | $0.0028 |
| 입력 - 캐시 미스 | $0.435 / 100만 토큰 | $0.14 |
| 출력 | $0.87 / 100만 토큰 | $0.28 |
| 동시 처리 제한 | 500 | 2,500 |
가격만 보면 V4-Pro보다 V4-Flash가 상당히 저렴하다. 따라서 복잡한 추론과 지식·코딩 성능이 필요한 작업은 Pro, 처리량과 비용 효율을 우선하는 작업은 Flash로 나눠볼 수 있다.
다만 현재 가격이 장기간 유지된다고 단정해서는 안 된다. 딥시크는 공식 가격 페이지에서 향후 API 전체 가격을 인상할 계획이며 인상 폭이 클 수 있다고 안내하고 있다. 구체적인 새 가격은 아직 공식 발표되지 않았다. (DeepSeek API Docs)
기존 V4 Pro 사용자는 모델명을 바꿔야 하나
바꿀 필요가 없다.
딥시크 공식 문서에 따르면 기존처럼 API 요청에서
deepseek-v4-pro
를 사용하면 최신 DeepSeek-V4-Pro-0813 버전에 접근한다. 엔드포인트 역시 기존 DeepSeek API 주소를 그대로 사용한다. (DeepSeek API Docs)
따라서 이미 V4 Pro를 연동해 사용하고 있었다면 버전 번호를 직접 모델명에 넣는 방식으로 코드를 수정하는 구조는 아니다.
벤치마크 수치는 어떻게 봐야 하나
딥시크가 공개한 V4 자료에서는 V4-Pro가 지식, 수학·STEM, 코딩, 장문 처리와 에이전트 작업에서 강점을 보인다고 설명한다. 다만 공식 모델 페이지에 공개된 상당수 세부 벤치마크는 V4 프리뷰 계열을 설명하기 위해 공개된 자료다. (DeepSeek API Docs)
따라서 이를 8월 13일 V4-Pro-0813의 독립적인 최신 벤치마크 결과와 동일하다고 단정하는 것은 피하는 편이 안전하다.
현재 공식 API 페이지에서는 V4-Pro-0813이라는 최신 버전과 사양·가격을 확인할 수 있지만, 이번 버전의 변경 사항을 이전 Pro 프리뷰와 항목별로 비교한 상세 릴리스 노트는 확인되는 공식 자료가 제한적이다.
이 부분은 추가 공식 발표가 나오면 다시 확인할 필요가 있다.
짧은 마무리
DeepSeek V4-Pro는 4월 프리뷰 공개를 거쳐 2026년 8월 13일 공식 API에서 DeepSeek-V4-Pro-0813 버전으로 확인된다. 100만 토큰 컨텍스트, 최대 384K 출력, Thinking 모드와 다양한 에이전트 API 지원이 핵심이다. (DeepSeek API Docs)
다만 새 버전의 세부 성능 변화까지 모두 공개된 것은 아니다. 현시점에서는 확인된 사양과 API 가격은 확정 정보로 보고, 구체적인 성능 향상 폭은 후속 공식 발표를 기다리는 편이 정확하다.
'[IT] 이야기 > [AI] 이야기' 카테고리의 다른 글
| ChatGPT GPT-5.6 Sol 개선, 무료 사용자는 GPT-5.6 Luna로 확대 (0) | 2026.08.11 |
|---|---|
| 바이브 코딩 모델별 철학 차이: GPT·Claude Code·Grok·Kimi는 무엇이 다른가 (0) | 2026.08.07 |
| OpenAI, Codex 리셋권을 판다고? 실제로는 ‘추가 크레딧’ 판매다 (0) | 2026.08.07 |
| 무료 Codex 스킬 설치했다가 .env 털린다? SKILL.md 공급망 공격의 실체 (0) | 2026.08.05 |
| Mythos 5는 가짜 GitHub 계정까지 만들었다|GPT-5.6 Sol과 함께 벌인 19개 월권 행동 (0) | 2026.08.05 |
댓글