모델 분석 · DeepSeek

DeepSeek V4 Pro 0813성능·벤치마크·API 가격

딥시크 V4 프로 0813 체크포인트의 지능·코딩·에이전트 결과를 모았습니다. 이전 V4 Pro와 구분하고 max·high의 평가 조건을 설명합니다.

딥시크 V4 프로 0813 · 코딩하는 상인 분석 · 출처별 저장일은 아래 표에 표시

Artificial Analysis 최고 순위 설정

DeepSeek V4 Pro 0813 (max)2026. 09. 07. 저장 · 전체 43
지능 지수
42
평가 작업 비용
$0.33
첫 응답
1.66 초

코딩하는 상인의 해석

같은 V4 Pro 이름인데 왜 서로 다른 결과가 나올까?

이 페이지는 0813 체크포인트로 명시된 결과만 묶습니다. 날짜가 없는 V4 Pro나 high-preview를 더해 점수 차이를 추론 설정의 효과로 설명하지 않습니다. Artificial Analysis의 max와 Arena의 high도 서로 다른 평가·실행 조건으로 남겨 둡니다.

동일한 Artificial Analysis 스냅샷 안에 0813의 다른 추론 강도 결과가 없어 설정 간 증감 계산을 제공하지 않습니다. 다른 체크포인트를 대신 넣지 않았으며 공식 API 단가도 아직 연결하지 않았습니다.

외부 기관이 측정한 공개 결과에 대한 2차 분석입니다. 코딩하는 상인이 직접 모델을 실행한 실험 결과는 포함하지 않았습니다.

원점수와 실행 조건

DeepSeek V4 Pro 0813의 출처별 평가 결과

모델명·체크포인트·제공사를 확인한 항목만 모았습니다. 순위는 각 원본 전체의 순위이며, 출처가 다른 점수나 순위를 평균내지 않습니다. 빈 값과 별표, 신뢰구간은 원본 표기를 유지합니다.

종합·효율

Artificial Analysis

2026. 09. 07. 저장

성능뿐 아니라 비용과 대기시간까지 고려하면 어떤 모델이 유리한가?

DeepSeek V4 Pro 0813, Artificial Analysis, 2026. 09. 07. 저장 결과
순위모델·실행 설정지능 지수평가 작업 비용출력 속도첫 응답전체 응답컨텍스트
43DeepSeek V4 Pro 0813 (max)추론 설정42$0.3371 t/s1.66 초37.09 초1M

영어 중심의 합성 지표이며 실제 한국어 업무 성능을 직접 보장하지 않습니다. 추론 강도별 결과는 같은 모델의 별도 실행 설정입니다.

대화 선호

Arena Text

2026. 09. 03. 저장

실제 사용자는 어떤 모델의 답변을 더 선호하는가?

DeepSeek V4 Pro 0813, Arena Text, 2026. 09. 03. 저장 결과
순위모델·실행 설정Arena 점수투표 수API 가격컨텍스트
52deepseek-v4-pro-high-202608131460 ±85,557$1.32 / $3.96N/A

사용자 구성과 프롬프트 분포에 영향을 받는 선호도 지표입니다. 특정 전문 업무의 정확도 순위로 해석하면 안 됩니다.

표의 API 가격 열은 이 평가사의 저장 당시 표기입니다. 검증한 공식 단가와 적용 조건은 아래 API 가격 영역에서 별도로 안내합니다.

코딩 선호

Arena Code

2026. 09. 07. 저장

코딩 대화에서 사용자가 더 만족한 모델은 무엇인가?

DeepSeek V4 Pro 0813, Arena Code, 2026. 09. 07. 저장 결과
순위모델·실행 설정Code Arena 점수투표 수API 가격컨텍스트
19deepseek-v4-pro-high-202608131582+11 / -113,518$1.32 / $3.96N/A

코드 실행 성공률만 측정하는 테스트가 아닙니다. 에이전트 하네스가 붙은 항목은 기본 모델과 동일하게 비교하면 안 됩니다.

표의 API 가격 열은 이 평가사의 저장 당시 표기입니다. 검증한 공식 단가와 적용 조건은 아래 API 가격 영역에서 별도로 안내합니다.

에이전트 실사용

Arena Agent

2026. 09. 07. 저장

실제 도구 사용 세션에서 끝까지 일을 잘 마친 모델은 무엇인가?

DeepSeek V4 Pro 0813, Arena Agent, 2026. 09. 07. 저장 결과
순위모델·실행 설정순 개선도확인된 성공칭찬 대 불만Bash 복구도구 환각세션 수
18DeepSeek V4 Pro (High) (0813)5.43% ±0.90%11.75% ±1.91%5.24% ±3.13%8.70% ±0.71%-0.78% ±0.13%34,397

수치는 절대 성공률이 아니라 평균 모델 대비 변화(%p)입니다. 음수는 감소를 뜻하며 도구 환각은 낮을수록 좋습니다. 다른 벤치마크와 점수를 합산할 수 없습니다.

다른 출처에 결과가 없다는 사실은 0점이나 해당 기능 미지원의 근거가 아닙니다. 동일 모델인지 확인되지 않은 항목은 연결하지 않았습니다.

평가 작업 비용과 별개

DeepSeek V4 Pro 0813 공식 API 가격

이 평가 항목과 일치하는 공식 API 단가를 아직 등록하지 않았습니다. 평가 작업 비용이나 Arena의 가격 표기를 공식 단가의 대체값으로 사용하지 않습니다.

검증된 단가로 API 예상 비용 계산하기 →

도입 전 판단

내 작업에서는 무엇을 확인해야 할까?

기존 V4 Pro에서 옮길 계획이라면 사용 중인 실제 모델 ID와 체크포인트를 먼저 기록하세요. 코드 답변 선호, 도구 세션의 성공 신호, 종합 지능은 각각 후보를 좁히는 단서입니다. 체크포인트를 고정한 같은 과제의 전후 결과가 있어야 교체 효과를 판단할 수 있습니다.

한국어 업무에 적용할 때는 실제로 반복하는 과제를 고정하고 모델 ID, 추론 설정, 입력·출력, 오류, 응답 시간과 청구 토큰을 함께 기록하세요. 이 페이지의 종합 지능 지수는 한국어 업무의 정확도나 수익 개선을 직접 측정한 결과가 아닙니다.