Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs StepFun: Step 3.5 Flash

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-16

Metriek DeepSeek V3.2 DeepSeek V3.2 medium Releasedatum: 2025-12-01 Step 3.5 Flash Step 3.5 Flash medium Releasedatum: 2026-02-01
Score 8.0 7.9
Rang #27 #30
Consistentie 8.2 9.1
Correcte tests
Slaagpercentage per poging 79.6% 70.6%
Instabiele tests 4 2
Totaal runs 54 49
Kosten per resultaat 0.240 0.000
Totale kosten $0.029 $0.000
Invoerprijs $0.260 / 1M $0.100 / 1M
Uitvoerprijs $0.380 / 1M $0.300 / 1M
Uitvoer-tokens 10,620 71,904
Redeneer-tokens 48,511 155,607
Responstijd (gem.) 46.41s 26.78s
Responstijd (max) 180.92s 170.45s
Responstijd (totaal) 835.33s 294.58s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 8.4 9.9 75.0% 0 30.72s 3,773 7,523
Step 3.5 Flash 10.0 10.0 100.0% 0 13.56s 14,376 17,668
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 4.7 1.6 66.7% 1 180.92s 626 6,792
Step 3.5 Flash - - - - - - - -
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
Step 3.5 Flash 10.0 10.0 100.0% 0 29.57s 1,176 12,984
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
Step 3.5 Flash 10.0 10.0 100.0% 0 15.01s 600 13,886
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 5.3 7.2 44.4% 1 39.32s 3,081 7,856
Step 3.5 Flash 5.3 7.2 44.4% 1 170.45s 45,350 90,436
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
Step 3.5 Flash 5.5 10.0 0.0% 0 6.54s 2,214 2,584
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
Step 3.5 Flash 8.5 6.8 83.3% 1 4.98s 2,284 3,412
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
Step 3.5 Flash 5.3 10.0 33.3% 0 7.72s 5,629 10,835
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859
Step 3.5 Flash 10.0 10.0 100.0% 0 11.91s 275 3,802

Snelle vergelijking

Vergelijkingspaar wisselen