Urambazaji
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Trinity Large Thinking (high) vs GPT-4o-mini

GPT-4o-mini inaongoza kwa average score: 5.0 vs 4.8. GPT-4o-mini ina gharama ya chini ya benchmark: $0.010 vs $0.632. GPT-4o-mini ni ya haraka zaidi: 1.99s vs 77.22s, na pass rates 39.4% vs 22.7%.

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-07-28

Nafasi
#202
Jumla ya tokeni za matokeo
953,758
Muda wa majibu (wastani)
77.22s
Jumla ya gharama
$0.632
Nafasi
#195
Jumla ya tokeni za matokeo
2,911
Muda wa majibu (wastani)
1.99s
Jumla ya gharama
$0.010
Muundo unaopendekezwa GPT-4o-mini

It has the best score here (5.0), while costing about 65.0x less than Trinity Large Thinking (high).

Ulinganisho wa kina

Kipimo Trinity Large Thinking Trinity Large Thinking high Toleo: 2026-07-28 GPT-4o-mini GPT-4o-mini none Toleo: 2024-07-18
Alama 4.8 5.0
Nafasi #202 #195
Uaminifu 9.9 10.0
Uthabiti 7.2 9.9
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio 39.4% 22.7%
Majaribio yasiyo thabiti 8 0
Jumla ya uendeshaji 66 66
Gharama kwa matokeo 12.640 0.195
Jumla ya gharama $0.632 $0.010
Bei ya ingizo $0.220 / 1M $0.150 / 1M
Bei ya toleo $0.850 / 1M $0.600 / 1M
Jumla ya tokeni za ingizo 101,767 53,136
Tokeni za matokeo 286,218 2,911
Tokeni za hoja 667,540 0
Muda wa majibu (wastani) 77.22s 1.99s
Muda wa majibu (upeo) 510.21s 7.58s
Muda wa majibu (jumla) 1698.89s 29.86s

Onyesho la kizazi cha modeli

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#202 Trinity Large Thinking

high
Gharama
$0.028
Muda
130.1s
Tokeni
34,387 tok

#195 GPT-4o-mini

none
Gharama
$0.001
Muda
6.6s
Tokeni
742 tok

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Uandishi wa msimbo Alama Uthabiti Kiwango cha kupita kwa kila jaribio Majaribio yasiyo thabiti Majaribio sahihi Muda wa majibu (wastani) Tokeni za ingizo Tokeni za matokeo Tokeni za hoja
Trinity Large Thinking 3.7 4.7 33.3% 2 245.04s 7,204 83,616 266,836
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho