Urambazaji
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (low) vs GPT-5.4 Mini

Trinity Large Thinking (low) inaongoza kwa average score: 6.0 vs 5.9. GPT-5.4 Mini ina gharama ya chini ya benchmark: $0.095 vs $0.656. GPT-5.4 Mini ni ya haraka zaidi: 1.53s vs 96.78s, na pass rates 48.5% vs 33.3%.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-28

Nafasi
#145
Jumla ya tokeni za matokeo
815,220
Muda wa majibu (wastani)
96.78s
Jumla ya gharama
$0.656
Nafasi
#153
Jumla ya tokeni za matokeo
7,880
Muda wa majibu (wastani)
1.53s
Jumla ya gharama
$0.095
Muundo unaopendekezwa GPT-5.4 Mini

Its score stays close to the best score here (5.9 vs 6.0), while costing about 6.9x less than Trinity Large Thinking (low).

Ulinganisho wa kina

Kipimo Trinity Large Thinking Trinity Large Thinking low Toleo: 2026-07-28 GPT-5.4 Mini GPT-5.4 Mini none Toleo: 2026-03-17
Alama 6.0 5.9
Nafasi #145 #153
Uaminifu 9.7 10.0
Uthabiti 7.9 8.9
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 48.5% 33.3%
Majaribio yasiyo thabiti 6 3
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 8.199 1.580
Jumla ya gharama $0.656 $0.095
Bei ya ingizo $0.220 / 1M $0.750 / 1M
Bei ya toleo $0.850 / 1M $4.500 / 1M
Jumla ya tokeni za ingizo 122,845 79,067
Tokeni za matokeo 117,704 7,880
Tokeni za hoja 697,516 0
Muda wa majibu (wastani) 96.78s 1.53s
Muda wa majibu (upeo) 540.96s 9.92s
Muda wa majibu (jumla) 2129.13s 33.74s

Onyesho la kizazi cha modeli

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#145 Trinity Large Thinking

low
Gharama
$0.021
Muda
173.2s
Tokeni
24,586 tok

#153 GPT-5.4 Mini

none
Gharama
$0.010
Muda
11.7s
Tokeni
2,151 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Trinity Large Thinking 5.3 10.0 33.3% 0 344.45s 5,441 27,039 217,241
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho