Navigasi
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Solar Pro 4

Trinity Large Thinking (medium) unggul dalam skor rata-rata dengan 6.0 vs 5.8. Solar Pro 4 memiliki biaya benchmark lebih rendah di $0.006 vs $0.792. Solar Pro 4 lebih cepat di 4.90s vs 84.96s, dengan tingkat keberhasilan 45.5% vs 31.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-11

Peringkat
#168
Total token output
1,002,646
Waktu respons (rata-rata)
84.96s
Total Biaya
$0.792
Peringkat
#175
Total token output
11,911
Waktu respons (rata-rata)
4.90s
Total Biaya
$0.006
Model yang direkomendasikan Solar Pro 4

Its score stays close to the best score here (5.8 vs 6.0), while costing about 147.8x less than Trinity Large Thinking (medium).

Perbandingan terperinci

Metrik Trinity Large Thinking Trinity Large Thinking medium Rilis: 2026-07-28 Solar Pro 4 Solar Pro 4 none Rilis: 2026-08-11
Skor 6.0 5.8
Peringkat #168 #175
Keandalan 10.0 10.0
Konsistensi 7.6 10.0
Cakupan benchmark 22/22 tes · 66/66 percobaan 22/22 tes · 66/66 percobaan
Tes benar
Tingkat lulus per percobaan 45.5% 31.8%
Tes tidak stabil 7 0
Total Run 66 66
Biaya per hasil 11.308 0.077
Total Biaya $0.792 $0.006
Harga input $0.220 / 1M $0.030 / 1M
Harga output $0.850 / 1M $0.120 / 1M
Total token input 118,477 130,854
Token output 148,823 11,911
Token penalaran 853,823 0
Waktu respons (rata-rata) 84.96s 4.90s
Waktu respons (maks) 525.14s 64.67s
Waktu respons (total) 1869.16s 107.82s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#168 Trinity Large Thinking

medium
Biaya
$0.016
Waktu
75.9s
Token
19,401 tok

#175 Solar Pro 4

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
$0.000
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Solar Pro 4 5.5 10.0 33.3% 0 2.61s 7,896 557 0

Perbandingan Cepat

Ganti Pasangan Perbandingan