Navigasi
Advertise here

Trinity Large Thinking (medium) vs Inkling (low)

Skor rata-rata hampir imbang di 6.1 vs 6.1. Inkling (low) memiliki biaya benchmark lebih rendah di $0.187 vs $0.756. Inkling (low) lebih cepat di 5.11s vs 85.44s, dengan tingkat keberhasilan 48.5% vs 54.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-10

Model yang Dibandingkan

Peringkat
#203
Total token output
1,016,785
Waktu respons (rata-rata)
85.44s
Total Biaya
$0.756
Peringkat
#202
Total token output
18,904
Waktu respons (rata-rata)
5.11s
Total Biaya
$0.187
Model yang direkomendasikan Inkling (low)

It has the best score here (6.1), while costing about 4.1x less than Trinity Large Thinking (medium).

Perbandingan terperinci

Metrik Trinity Large Thinking Trinity Large Thinking medium Rilis: 2026-07-28 Inkling Inkling low Rilis: 2026-07-18
Skor 6.1 6.1
Peringkat #203 #202
Keandalan 10.0 10.0
Konsistensi 7.9 8.6
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 48.5% 54.6%
Tes tidak stabil 6 4
Total Run 66 66
Biaya per hasil 9.972 1.865
Total Biaya $0.756 $0.187
Harga input $0.250 / 1M $1.000 / 1M
Harga output $0.800 / 1M $4.050 / 1M
Total token input 118,486 109,893
Token output 156,166 8,580
Token penalaran 860,619 10,324
Waktu respons (rata-rata) 85.44s 5.11s
Waktu respons (maks) 525.14s 41.58s
Waktu respons (total) 1879.75s 112.46s
Parameter 398B total (13B aktif) 975B total (41B aktif)
Ketersediaan Bobot tersedia Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#203 Trinity Large Thinking

medium
Biaya
$0.016
Waktu
75.9s
Token
19,401 tok

#202 Thinking Machines: Inkling

low
Biaya
$0.002
Waktu
6.1s
Token
502 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Inkling 5.1 7.2 22.2% 1 8.71s 7,374 355 4,961

Perbandingan Cepat

Ganti Pasangan Perbandingan