Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 Mini vs Hunter Alpha

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-03-17

Metriek GPT-5.4 Mini GPT-5.4 Mini medium Releasedatum: 2026-03-17 Hunter Alpha Hunter Alpha medium Releasedatum: Onbekende releasedatum
Rang #34 #35
Score 7.1 7.0
Consistentie 7.2 7.2
Kosten per resultaat 3.610 0.000
Totale kosten $0.289 $0.000
Correcte tests
Slaagpercentage per poging 68.6% 68.6%
Instabiele tests 6 6
Totaal runs 51 51
Uitvoer-tokens 1,708 4,724
Redeneer-tokens 58,019 17,921
Responstijd (gem.) 15.66s 10.33s
Responstijd (max) 102.91s 30.53s
Responstijd (totaal) 266.14s 175.60s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 8.6 7.9 91.7% 1 4.05s 296 2,876
Hunter Alpha 7.3 5.8 83.3% 2 4.75s 479 1,103
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 10.0 10.0 100.0% 0 17.81s 317 4,317
Hunter Alpha 4.7 1.6 66.7% 1 30.53s 792 3,456
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 10.0 10.0 100.0% 0 2.43s 234 650
Hunter Alpha 10.0 10.0 100.0% 0 23.16s 1,488 8,017
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 4.1 4.4 44.5% 2 65.31s 60 43,286
Hunter Alpha 3.0 10.0 0.0% 0 10.52s 892 2,406
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 4.5 10.0 0.0% 0 3.72s 150 510
Hunter Alpha 7.0 3.7 66.7% 1 6.44s 116 260
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 7.4 6.5 66.7% 1 2.50s 129 1,337
Hunter Alpha 9.9 10.0 100.0% 0 4.18s 208 465
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 6.8 7.9 55.6% 1 4.33s 271 2,449
Hunter Alpha 6.1 4.7 66.7% 2 5.36s 441 1,310
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
GPT-5.4 Mini 4.7 1.6 66.7% 1 9.62s 251 2,594
Hunter Alpha 10.0 10.0 100.0% 0 17.33s 308 904

Snelle vergelijking

Vergelijkingspaar wisselen