Navigasi
AI BENCHY
Advertise here

Claude Sonnet 5 vs Trinity Large Thinking (medium)

Skor rata-rata hampir imbang di 6.1 vs 6.1. Claude Sonnet 5 memiliki biaya benchmark lebih rendah di $0.548 vs $0.798. Claude Sonnet 5 lebih cepat di 6.05s vs 85.44s, dengan tingkat keberhasilan 40.9% vs 48.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-14

Peringkat
#161
Total token output
22,508
Waktu respons (rata-rata)
6.05s
Total Biaya
$0.548
Peringkat
#169
Total token output
1,016,785
Waktu respons (rata-rata)
85.44s
Total Biaya
$0.798
Model yang direkomendasikan Claude Sonnet 5

It has the best score here (6.1), while responding about 14.1x faster than Trinity Large Thinking (medium).

Perbandingan terperinci

Metrik Claude Sonnet 5 Claude Sonnet 5 none Rilis: 2026-06-30 Trinity Large Thinking Trinity Large Thinking medium Rilis: 2026-07-28
Skor 6.1 6.1
Peringkat #161 #169
Keandalan 10.0 10.0
Konsistensi 8.7 7.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 40.9% 48.5%
Tes tidak stabil 4 6
Total Run 66 66
Biaya per hasil 7.817 9.972
Total Biaya $0.548 $0.798
Harga input $2.000 / 1M $0.220 / 1M
Harga output $10.000 / 1M $0.850 / 1M
Total token input 161,032 118,486
Token output 22,508 156,166
Token penalaran 0 860,619
Waktu respons (rata-rata) 6.05s 85.44s
Waktu respons (maks) 33.39s 525.14s
Waktu respons (total) 132.99s 1879.75s
Parameter ~1T total (~100B aktif) 398B total (13B aktif)
Ketersediaan Tertutup Bobot tersedia

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#161 Claude Sonnet 5

none
Biaya
$0.061
Waktu
53.7s
Token
6,172 tok

#169 Trinity Large Thinking

medium
Biaya
$0.016
Waktu
75.9s
Token
19,401 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Sonnet 5 4.6 7.9 22.2% 1 3.67s 10,590 1,864 0
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

Perbandingan Cepat

Ganti Pasangan Perbandingan