Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Qwen: Qwen3.5-35B-A3B

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-11

Metriek GPT-5.4 Nano GPT-5.4 Nano medium Releasedatum: 2026-03-17 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Releasedatum: 2026-02-24
Score 7.6 7.4
Rang #35 #40
Consistentie 9.0 6.7
Correcte tests
Slaagpercentage per poging 68.5% 79.6%
Instabiele tests 2 7
Totaal runs 54 54
Kosten per resultaat 0.747 3.976
Totale kosten $0.083 $0.398
Invoerprijs $0.200 / 1M $0.163 / 1M
Uitvoerprijs $1.250 / 1M $1.300 / 1M
Uitvoer-tokens 2,946 10,137
Redeneer-tokens 58,132 208,761
Responstijd (gem.) 11.21s 44.51s
Responstijd (max) 94.06s 106.00s
Responstijd (totaal) 201.80s 801.21s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 683 2,254
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 798 42,652
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 10.0 10.0 100.0% 0 13.41s 472 3,616
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 79.09s 4,273 33,078
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 349 5,719
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 775 12,485
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 234 516
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 235 19,493
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 60 43,325
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 41 46,368
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 179 443
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 20 3,753
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 95 521
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 97 17,361
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 4.0 7.1 22.2% 1 3.65s 640 1,356
Qwen3.5-35B-A3B 6.4 4.4 77.8% 2 31.58s 3,589 32,206
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 234 382
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 309 1,365

Snelle vergelijking

Vergelijkingspaar wisselen