Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Qwen: Qwen3.5 Plus 2026-02-15

Samenvatting

Benchmarkvergelijking DeepSeek V4 Pro vs Qwen3.5 Plus 2026-02-15: DeepSeek V4 Pro leidt in gemiddelde score met 8.1 vs 8.0. DeepSeek V4 Pro heeft lagere benchmarkkosten met $0.098 vs $0.310. DeepSeek V4 Pro is sneller met 72.22s vs 73.79s, met slagingspercentages van 66.7% vs 73.0%.

Aanbevolen model: DeepSeek V4 Pro - Het heeft hier de beste score (8.1) en kost ongeveer 3.2x minder dan Qwen3.5 Plus 2026-02-15.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-12

Metriek DeepSeek V4 Pro DeepSeek V4 Pro high Releasedatum: 2026-04-24 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Releasedatum: 2026-02-15
Score 8.1 8.0
Rang #30 #32
Betrouwbaarheid 9.6 10.0
Consistentie 7.8 8.8
Correcte tests
Slaagpercentage per poging 66.7% 73.0%
Instabiele tests 6 3
Totaal runs 57 63
Kosten per resultaat 0.978 2.445
Totale kosten $0.098 $0.310
Invoerprijs $0.435 / 1M $0.260 / 1M
Uitvoerprijs $0.870 / 1M $1.560 / 1M
Totaal aantal invoer-tokens 35,122 40,918
Uitvoer-tokens 6,315 2,159
Redeneer-tokens 93,205 189,604
Responstijd (gem.) 72.22s 73.79s
Responstijd (max) 437.44s 266.69s
Responstijd (totaal) 1444.45s 1033.07s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#32 Qwen3.5 Plus 2026-02-15

medium
Cost
$0.011
Time
125.5s
Tokens
7,040 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 5.7 5.9 58.3% 2 25.70s 536 149 3,214
Qwen3.5 Plus 2026-02-15 8.2 7.9 83.3% 1 45.78s 672 205 21,236
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.7 10.0 66.7% 0 308.19s 1,583 368 42,658
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 38.17s 14,060 454 5,836
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.85s 14,934 421 7,906
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 25.03s 7,690 274 2,166
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.91s 7,782 270 14,916
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 3.6 7.2 22.2% 1 130.09s 472 4,400 26,367
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 17.50s 444 35 16,680
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 8.83s 471 115 1,013
Qwen3.5 Plus 2026-02-15 4.7 1.6 66.7% 1 79.86s 344 73 8,675
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.8 6.6 83.3% 1 8.73s 627 66 2,726
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 31.93s 699 101 7,704
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 6.9 4.9 77.8% 2 56.85s 591 178 2,563
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 32.50s 696 301 13,853
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 9.8 10.0 100.0% 0 15.92s 8,909 295 701
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 7.54s 8,193 309 909
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 3.0 10.0 0.0% 0 34.01s 183 16 5,961
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 103.81s 204 24 17,130

Snelle vergelijking

Vergelijkingspaar wisselen