Navigare
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs OpenAI: GPT-5.4 Nano

Rezumat

Comparație benchmark DeepSeek V4 Pro vs GPT-5.4 Nano: DeepSeek V4 Pro conduce la scorul mediu cu 7.6 vs 7.5. GPT-5.4 Nano are costul de benchmark mai mic, $0.107 vs $0.157. GPT-5.4 Nano este mai rapid cu 11.95s vs 77.20s, cu rate de reușită de 66.7% vs 63.5%.

Model recomandat: GPT-5.4 Nano - Scorul rămâne aproape de cel mai bun scor de aici (7.5 vs 7.6) și răspunde de aproximativ 6.5x mai rapid decât DeepSeek V4 Pro.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-17

Metrică DeepSeek V4 Pro DeepSeek V4 Pro high Lansare: 2026-04-24 GPT-5.4 Nano GPT-5.4 Nano medium Lansare: 2026-03-17
Scor 7.6 7.5
Rang #41 #46
Fiabilitate 9.3 10.0
Consistență 7.0 8.4
Teste corecte
Rată de trecere pe încercare 66.7% 63.5%
Teste instabile 8 4
Rulări totale 63 63
Cost per rezultat 1.742 0.969
Cost total $0.157 $0.107
Preț de intrare $0.435 / 1M $0.200 / 1M
Preț de ieșire $0.870 / 1M $1.250 / 1M
Total tokenuri de intrare 38,726 35,434
Tokenuri de ieșire 6,334 3,014
Tokenuri de raționament 159,151 76,520
Timp de răspuns (mediu) 77.20s 11.95s
Timp de răspuns (maxim) 416.76s 94.06s
Timp de răspuns (total) 1621.17s 250.98s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#46 GPT-5.4 Nano

medium
Cost
$0.007
Time
24.6s
Tokens
4,943 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 5.7 5.9 58.3% 2 25.70s 536 149 3,214
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 606 683 2,254
Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 6.1 4.6 66.7% 2 243.00s 5,090 383 84,580
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Combinat Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 10.0 10.0 100.0% 0 38.17s 14,060 454 5,836
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 12,345 349 5,719
Parsare și extragere de date Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 10.0 10.0 100.0% 0 25.03s 7,690 274 2,166
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 7,140 234 516
Specific domeniului Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 3.6 7.2 22.2% 1 151.46s 569 4,404 50,391
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 619 60 43,325
Inteligență generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 10.0 10.0 100.0% 0 8.83s 471 115 1,013
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 477 179 443
Respectarea instrucțiunilor Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 7.8 6.6 83.3% 1 8.73s 627 66 2,726
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 660 95 521
Rezolvare de puzzle-uri Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 6.9 4.9 77.8% 2 56.85s 591 178 2,563
GPT-5.4 Nano 4.1 7.2 22.2% 1 3.79s 642 594 1,408
Apelare instrumente Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 9.8 10.0 100.0% 0 15.92s 8,909 295 701
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 5,445 234 382
Cultură generală Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
DeepSeek V4 Pro 3.0 10.0 0.0% 0 34.01s 183 16 5,961
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 195 70 1,174

Comparație rapidă

Schimbă perechea de comparație