Navigatie
Advertise here

Trinity Large Thinking (low) vs KAT-Coder-Pro V2.5 (medium)

Trinity Large Thinking (low) leidt in gemiddelde score met 6.3 vs 6.2. KAT-Coder-Pro V2.5 (medium) heeft lagere benchmarkkosten met $0.478 vs $0.700. KAT-Coder-Pro V2.5 (medium) is sneller met 23.94s vs 95.16s, met slagingspercentages van 47.8% vs 62.3%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-01

Vergeleken modellen

Rang
#222
Totaal aantal uitvoer-tokens
842,200
Responstijd (gem.)
95.16s
Totale kosten
$0.700
Rang
#226
Totaal aantal uitvoer-tokens
139,375
Responstijd (gem.)
23.94s
Totale kosten
$0.478
Aanbevolen model KAT-Coder-Pro V2.5 (medium)

De score blijft dicht bij de beste score hier (6.2 vs 6.3) en het reageert ongeveer 4.0x sneller dan Trinity Large Thinking (low).

Gedetailleerde vergelijking

Metriek Trinity Large Thinking Trinity Large Thinking low Releasedatum: 2026-07-28 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium Releasedatum: 2026-07-14
Score 6.3 6.2
Rang #222 #226
Betrouwbaarheid 10.0 10.0
Consistentie 8.1 7.2
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 47.8% 62.3%
Instabiele tests 6 8
Totaal runs 69 69
Kosten per resultaat 9.163 4.342
Totale kosten $0.700 $0.478
Invoerprijs $0.250 / 1M $0.740 / 1M
Uitvoerprijs $0.800 / 1M $2.960 / 1M
Totaal aantal invoer-tokens 347,980 87,916
Uitvoer-tokens 121,898 7,213
Redeneer-tokens 720,302 132,162
Responstijd (gem.) 95.16s 23.94s
Responstijd (max) 540.96s 257.00s
Responstijd (totaal) 2188.74s 550.52s
Parameters 398B totaal (13B actief) ~700B totaal (~72B actief)
Beschikbaarheid Gewichten beschikbaar Gesloten broncode

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Trinity Large Thinking

low
Kosten
$0.021
Tijd
173.2s
Tokens
24,586 tok

#226 KAT-Coder-Pro V2.5

medium
Kosten
$0.009
Tijd
25.6s
Tokens
2,939 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658

Snelle vergelijking

Vergelijkingspaar wisselen