Navigate
Advertise here

DeepSeek V4 Pro vs MiMo-V2.5-Pro (medium)

The average score is effectively tied at 6.8 vs 6.8. DeepSeek V4 Pro has the lower benchmark cost at $0.206 vs $0.221. DeepSeek V4 Pro is faster at 11.71s vs 48.68s, with pass rates of 47.0% vs 63.6%.

Last updated at: 2026-09-24

Compared models

Rank
#180
Total Output Tokens
35,547
Response Time (avg)
11.71s
Total Cost
$0.206
Rank
#182
Total Output Tokens
185,466
Response Time (avg)
48.68s
Total Cost
$0.221
Recommended model DeepSeek V4 Pro

It has the best score here (6.8), while responding about 4.2x faster than MiMo-V2.5-Pro (medium).

Detailed comparison

Metric DeepSeek V4 Pro DeepSeek V4 Pro none Release: 2026-04-24 MiMo-V2.5-Pro MiMo-V2.5-Pro medium Release: 2026-04-22
Score 6.8 6.8
Rank #180 #182
Reliability 10.0 10.0
Consistency 8.6 7.9
Attempts 66/66 66/66
Tests Correct
Attempt pass rate 47.0% 63.6%
Flaky tests 4 6
Total Runs 66 66
Cost per result 1.061 3.790
Total Cost $0.206 $0.221
Input Price $0.940 / 1M $0.435 / 1M
Output Price $1.880 / 1M $0.870 / 1M
Total Input Tokens 148,078 139,892
Output Tokens 35,547 15,569
Reasoning Tokens 0 169,897
Response Time (avg) 11.71s 48.68s
Response Time (max) 119.44s 333.34s
Response Time (total) 257.67s 1071.02s
Parameters 1.6T total (49B active) 1.02T total (42B active)
Availability Open source Open source

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#180 DeepSeek V4 Pro

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Cost
$0.000
Time
300.0s
Tokens
0 tok

#182 MiMo-V2.5-Pro

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Cost
$0.000
Time
300.0s
Tokens
0 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

Quick Compare

Switch Comparison Pair