Navigate
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4.1 Flash (low) vs GPT-5.4 Nano (medium)

DeepSeek V4.1 Flash (low) leads on average score with 8.0 vs 8.0. DeepSeek V4.1 Flash (low) has the lower benchmark cost at $0.153 vs $0.187. GPT-5.4 Nano (medium) is faster at 15.95s vs 28.04s, with pass rates of 73.9% vs 66.7%.

Last updated at: 2026-10-01

Compared models

Rank
#90
Total Output Tokens
371,547
Response Time (avg)
28.04s
Total Cost
$0.153
Rank
#93
Total Output Tokens
110,910
Response Time (avg)
15.95s
Total Cost
$0.187
Recommended model GPT-5.4 Nano (medium)

Its score stays close to the best score here (8.0 vs 8.0), while responding about 1.8x faster than DeepSeek V4.1 Flash (low).

Detailed comparison

Metric DeepSeek V4.1 Flash DeepSeek V4.1 Flash low Release: 2026-09-10 GPT-5.4 Nano GPT-5.4 Nano medium Release: 2026-03-17
Score 8.0 8.0
Rank #90 #93
Reliability 9.6 10.0
Consistency 8.7 8.6
Attempts 69/69 69/69
Tests Correct
Attempt pass rate 73.9% 66.7%
Flaky tests 4 4
Total Runs 69 69
Cost per result 1.576 1.432
Total Cost $0.153 $0.187
Input Price $0.020 / 1M $0.200 / 1M
Output Price $0.396 / 1M $1.250 / 1M
Total Input Tokens 266,849 237,088
Output Tokens 8,284 8,235
Reasoning Tokens 363,263 102,675
Response Time (avg) 28.04s 15.95s
Response Time (max) 149.84s 94.06s
Response Time (total) 645.03s 366.93s
Parameters 748B total (16B active) ~120B total (~5B active)
Availability Open source Closed

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#90 DeepSeek V4.1 Flash

low
Cost
$0.017
Time
43.6s
Tokens
14,069 tok

#93 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 40.66s 7,509 378 81,978
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778

Quick Compare

Switch Comparison Pair