Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs OpenAI: GPT-5.3 Chat

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-02

Metriek DeepSeek V3.2 DeepSeek V3.2 medium Releasedatum: 2025-12-01 GPT-5.3 Chat GPT-5.3 Chat none Releasedatum: 2026-03-03
Score 6.9 7.4
Rang #81 #57
Betrouwbaarheid 10.0 10.0
Consistentie 7.9 8.4
Correcte tests
Slaagpercentage per poging 63.3% 68.3%
Instabiele tests 6 4
Totaal runs 60 60
Kosten per resultaat 0.335 3.350
Totale kosten $0.037 $0.402
Invoerprijs $0.252 / 1M $1.750 / 1M
Uitvoerprijs $0.378 / 1M $14.000 / 1M
Totaal aantal invoer-tokens 35,744 31,590
Uitvoer-tokens 7,177 24,757
Redeneer-tokens 68,297 0
Responstijd (gem.) 53.34s 6.13s
Responstijd (max) 189.03s 18.33s
Responstijd (totaal) 1066.71s 122.61s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 8.7 10.0 83.3% 1 24.23s 448 3,247 6,953
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 606 3,167 0
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 3.9 5.8 33.3% 1 184.97s 3,128 640 21,230
GPT-5.3 Chat 6.9 6.2 66.7% 1 10.52s 4,683 4,772 0
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 14,283 571 6,296
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 11,019 2,614 0
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 7,388 207 7,693
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 7,140 942 0
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 2.9 4.4 22.2% 2 24.27s 472 21 6,838
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 723 8,264 0
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 3.4 2.5 33.3% 1 58.29s 314 49 2,189
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 477 319 0
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 627 1,397 2,845
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 660 1,491 0
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 7.0 7.2 55.6% 1 37.69s 594 518 6,375
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 642 1,758 0
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 8,307 507 859
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 5,445 861 0
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 3.0 10.0 0.0% 0 83.99s 183 20 7,019
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 195 569 0

Snelle vergelijking

Vergelijkingspaar wisselen