Navigatie
AI BENCHY
Advertise here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Qwen: Qwen3.7 Max

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-04

Metriek GPT-5.4 GPT-5.4 medium Releasedatum: 2026-03-05 Qwen3.7 Max Qwen3.7 Max medium Releasedatum: 2026-05-22
Score 8.0 9.1
Rang #21 #5
Betrouwbaarheid 10.0 10.0
Consistentie 8.6 9.6
Correcte tests
Slaagpercentage per poging 76.2% 88.9%
Instabiele tests 4 1
Totaal runs 63 63
Kosten per resultaat 8.640 5.517
Totale kosten $1.210 $0.523
Invoerprijs $2.500 / 1M $1.250 / 1M
Uitvoerprijs $15.000 / 1M $3.750 / 1M
Totaal aantal invoer-tokens 34,108 42,360
Uitvoer-tokens 2,242 2,129
Redeneer-tokens 72,707 122,959
Responstijd (gem.) 22.35s 16.02s
Responstijd (max) 100.41s 59.98s
Responstijd (totaal) 469.29s 336.51s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
Qwen3.7 Max 10.0 10.0 100.0% 0 6.36s 672 222 8,742
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
Qwen3.7 Max 10.0 10.0 100.0% 0 19.60s 14,934 366 8,405
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
Qwen3.7 Max 10.0 10.0 100.0% 0 8.80s 7,782 270 6,254
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Qwen3.7 Max 5.9 7.2 55.6% 1 24.94s 771 61 31,793
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
Qwen3.7 Max 10.0 10.0 100.0% 0 11.70s 516 135 4,457
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
Qwen3.7 Max 10.0 10.0 100.0% 0 7.46s 699 102 5,452
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
Qwen3.7 Max 10.0 10.0 100.0% 0 8.84s 696 259 8,908
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
Qwen3.7 Max 10.0 10.0 100.0% 0 6.63s 8,193 267 1,220
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821
Qwen3.7 Max 3.0 10.0 0.0% 0 33.37s 204 24 12,920

Snelle vergelijking

Vergelijkingspaar wisselen