Urambazaji
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (low) vs KAT-Coder-Pro V2.5 (medium)

Trinity Large Thinking (low) inaongoza kwa average score: 6.3 vs 6.2. KAT-Coder-Pro V2.5 (medium) ina gharama ya chini ya benchmark: $0.478 vs $0.700. KAT-Coder-Pro V2.5 (medium) ni ya haraka zaidi: 23.94s vs 95.16s, na pass rates 47.8% vs 62.3%.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-10-01

Modeli zilizolinganishwa

Nafasi
#222
Jumla ya tokeni za matokeo
842,200
Muda wa majibu (wastani)
95.16s
Jumla ya gharama
$0.700
Nafasi
#226
Jumla ya tokeni za matokeo
139,375
Muda wa majibu (wastani)
23.94s
Jumla ya gharama
$0.478
Muundo unaopendekezwa KAT-Coder-Pro V2.5 (medium)

Its score stays close to the best score here (6.2 vs 6.3), while responding about 4.0x faster than Trinity Large Thinking (low).

Ulinganisho wa kina

Kipimo Trinity Large Thinking Trinity Large Thinking low Toleo: 2026-07-28 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium Toleo: 2026-07-14
Alama 6.3 6.2
Nafasi #222 #226
Uaminifu 10.0 10.0
Uthabiti 8.1 7.2
Majaribio 69/69 69/69
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 47.8% 62.3%
Majaribio yasiyo thabiti 6 8
Jumla ya uendeshaji 69 69
Gharama kwa matokeo 9.163 4.342
Jumla ya gharama $0.700 $0.478
Bei ya ingizo $0.250 / 1M $0.740 / 1M
Bei ya toleo $0.800 / 1M $2.960 / 1M
Jumla ya tokeni za ingizo 347,980 87,916
Tokeni za matokeo 121,898 7,213
Tokeni za hoja 720,302 132,162
Muda wa majibu (wastani) 95.16s 23.94s
Muda wa majibu (upeo) 540.96s 257.00s
Muda wa majibu (jumla) 2188.74s 550.52s
Vigezo 398B jumla (13B vinavyotumika) ~700B jumla (~72B vinavyotumika)
Upatikanaji Uzani unapatikana Imefungwa

Onyesho la kizazi cha modeli

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#222 Trinity Large Thinking

low
Gharama
$0.021
Muda
173.2s
Tokeni
24,586 tok

#226 KAT-Coder-Pro V2.5

medium
Gharama
$0.009
Muda
25.6s
Tokeni
2,939 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho