Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Qwen: Qwen3.5-35B-A3B

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-03-17

Metriek GPT-5.4 Mini GPT-5.4 Mini medium Releasedatum: 2026-03-17 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Releasedatum: 2026-02-24
Rang #34 #31
Score 7.1 7.3
Consistentie 7.2 6.6
Kosten per resultaat 3.610 3.877
Totale kosten $0.289 $0.349
Correcte tests
Slaagpercentage per poging 68.6% 78.4%
Instabiele tests 6 7
Totaal runs 51 51
Uitvoer-tokens 1,708 5,864
Redeneer-tokens 58,019 175,683
Responstijd (gem.) 15.66s 42.48s
Responstijd (max) 102.91s 106.00s
Responstijd (totaal) 266.14s 722.12s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 798 42,652
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 775 12,485
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 235 19,493
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 41 46,368
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 20 3,753
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 7.4 6.5 66.7% 1 2.50s 129 1,337
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 97 17,361
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
Qwen3.5-35B-A3B 6.4 4.4 77.8% 2 31.58s 3,589 32,206
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 309 1,365

Snelle vergelijking

Vergelijkingspaar wisselen