DeepSeek V4 Pro (Reasoning) — benchmark results

Provider: DeepSeek. Released 2026-04-23. Access: Open.

Unified ELO 1809 ± 34, rank #134 of 1776 rated models, from 8 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard62.26UGI Score99.1
UGI - Writing68.4Writing Score98.3
UGI - Natural Intelligence67.03NatInt Score97.2
Wolfram LLM Benchmarking Project62.7Correct Functionality (%)92.5
GRIPS92.9Accuracy (%)76.9
GRIPS-hard67.3Accuracy (%)76.9
SpeechMap Compliance64.8% Requests Completed53.5
UGI - Willingness (W/10)3.2W/10 Score24.1

Interactive version: aibenchmarks.dev/model?slug=deepseek-v4-pro-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.