Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs GPT-5.4 Nano

De gemiddelde score is vrijwel gelijk met 4.8 vs 4.8. GPT-5.4 Nano heeft lagere benchmarkkosten met $0.041 vs $0.592. GPT-5.4 Nano is sneller met 2.56s vs 75.86s, met slagingspercentages van 39.4% vs 27.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-10

Vergeleken modellen

Rang
#288
Totaal aantal uitvoer-tokens
932,619
Responstijd (gem.)
75.86s
Totale kosten
$0.592
Rang
#287
Totaal aantal uitvoer-tokens
13,794
Responstijd (gem.)
2.56s
Totale kosten
$0.041
Aanbevolen model GPT-5.4 Nano

Het heeft hier de beste score (4.8) en kost ongeveer 14.6x minder dan Trinity Large Thinking (high).

Gedetailleerde vergelijking

Metriek Trinity Large Thinking Trinity Large Thinking high Releasedatum: 2026-07-28 GPT-5.4 Nano GPT-5.4 Nano none Releasedatum: 2026-03-17
Score 4.8 4.8
Rang #288 #287
Betrouwbaarheid 10.0 10.0
Consistentie 7.2 8.6
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 39.4% 27.3%
Instabiele tests 8 4
Totaal runs 66 66
Kosten per resultaat 12.473 1.011
Totale kosten $0.592 $0.041
Invoerprijs $0.250 / 1M $0.200 / 1M
Uitvoerprijs $0.800 / 1M $1.250 / 1M
Totaal aantal invoer-tokens 101,776 115,933
Uitvoer-tokens 276,367 13,794
Redeneer-tokens 656,252 0
Responstijd (gem.) 75.86s 2.56s
Responstijd (max) 510.21s 25.50s
Responstijd (totaal) 1668.93s 56.37s
Parameters 398B totaal (13B actief) ~120B totaal (~5B actief)
Beschikbaarheid Gewichten beschikbaar Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#288 Trinity Large Thinking

high
Kosten
$0.028
Tijd
130.1s
Tokens
34,387 tok

#287 GPT-5.4 Nano

none
Kosten
$0.008
Tijd
46.1s
Tokens
5,735 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

Snelle vergelijking

Vergelijkingspaar wisselen