Navigatie
Advertise here

Trinity Large Thinking (low) vs GPT-5 Nano (medium)

Trinity Large Thinking (low) leidt in gemiddelde score met 6.0 vs 6.0. GPT-5 Nano (medium) heeft lagere benchmarkkosten met $0.118 vs $0.625. GPT-5 Nano (medium) is sneller met 54.20s vs 96.61s, met slagingspercentages van 47.0% vs 54.5%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-09-10

Vergeleken modellen

Rang
#208
Totaal aantal uitvoer-tokens
818,359
Responstijd (gem.)
96.61s
Totale kosten
$0.625
Rang
#213
Totaal aantal uitvoer-tokens
282,437
Responstijd (gem.)
54.20s
Totale kosten
$0.118
Aanbevolen model GPT-5 Nano (medium)

De score blijft dicht bij de beste score hier (6.0 vs 6.0) en het kost ongeveer 5.3x minder dan Trinity Large Thinking (low).

Gedetailleerde vergelijking

Metriek Trinity Large Thinking Trinity Large Thinking low Releasedatum: 2026-07-28 GPT-5 Nano GPT-5 Nano medium Releasedatum: 2025-08-07
Score 6.0 6.0
Rang #208 #213
Betrouwbaarheid 10.0 10.0
Consistentie 8.3 6.6
Pogingen 66/66 66/66
Correcte tests
Slaagpercentage per poging 47.0% 54.5%
Instabiele tests 5 9
Totaal runs 66 66
Kosten per resultaat 8.221 1.472
Totale kosten $0.625 $0.118
Invoerprijs $0.250 / 1M $0.050 / 1M
Uitvoerprijs $0.800 / 1M $0.400 / 1M
Totaal aantal invoer-tokens 122,854 94,944
Uitvoer-tokens 119,810 12,037
Redeneer-tokens 698,549 270,400
Responstijd (gem.) 96.61s 54.20s
Responstijd (max) 540.96s 227.89s
Responstijd (totaal) 2125.51s 867.23s
Parameters 398B totaal (13B actief) ~120B totaal (~5B actief)
Beschikbaarheid Gewichten beschikbaar Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#208 Trinity Large Thinking

low
Kosten
$0.021
Tijd
173.2s
Tokens
24,586 tok

#213 GPT-5 Nano

medium
Kosten
$0.006
Tijd
108.5s
Tokens
13,209 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

Snelle vergelijking

Vergelijkingspaar wisselen