Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs OpenAI: gpt-oss-120b

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-03

Metriek DeepSeek V4 Pro DeepSeek V4 Pro high Releasedatum: 2026-04-24 gpt-oss-120b gpt-oss-120b medium Releasedatum: 2025-08-05 Gratis beschikbaar
Score 6.1 5.9
Rang #100 #103
Betrouwbaarheid 8.9 10.0
Consistentie 7.6 7.9
Correcte tests
Slaagpercentage per poging 55.0% 50.0%
Instabiele tests 6 5
Totaal runs 60 60
Kosten per resultaat 2.660 0.151
Totale kosten $0.062 $0.012
Invoerprijs $0.435 / 1M $0.039 / 1M
Uitvoerprijs $0.870 / 1M $0.180 / 1M
Totaal aantal invoer-tokens 30,514 36,355
Uitvoer-tokens 12,244 17,495
Redeneer-tokens 53,958 46,878
Responstijd (gem.) 58.92s 22.41s
Responstijd (max) 358.35s 68.16s
Responstijd (totaal) 1119.51s 291.35s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 6.4 7.9 58.3% 1 16.53s 448 71 3,617
gpt-oss-120b 6.7 9.9 50.0% 0 10.21s 1,314 3,518 2,177
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 2.7 5.7 16.7% 1 51.77s 240 105 2,641
gpt-oss-120b 3.9 5.6 33.3% 1 47.24s 5,053 847 8,618
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 65.02s 14,016 465 5,914
gpt-oss-120b 10.0 10.0 100.0% 0 31.18s 11,535 694 5,072
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 7.3 5.9 83.3% 1 23.62s 5,633 229 1,710
gpt-oss-120b 6.4 5.9 66.7% 1 1.98s 7,476 241 1,114
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 2.9 7.2 11.1% 1 205.66s 430 10,529 28,089
gpt-oss-120b 2.9 4.4 22.2% 2 50.92s 1,266 6,784 20,606
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 6.1 3.1 66.7% 1 25.09s 314 76 1,152
gpt-oss-120b 4.3 10.0 0.0% 0 7.90s 659 107 387
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 41.16s 627 205 2,416
gpt-oss-120b 9.9 10.0 100.0% 0 7.63s 1,036 126 1,799
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 5.9 7.2 55.6% 1 34.84s 544 139 4,019
gpt-oss-120b 5.3 7.2 44.4% 1 21.71s 1,190 1,790 2,264
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 10.0 10.0 100.0% 0 21.33s 8,079 372 593
gpt-oss-120b 9.8 10.0 100.0% 0 6.91s 6,514 287 1,083
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
DeepSeek V4 Pro 3.0 10.0 0.0% 0 39.14s 183 53 3,807
gpt-oss-120b 3.0 10.0 0.0% 0 26.51s 312 3,101 3,758

Snelle vergelijking

Vergelijkingspaar wisselen