Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Sonnet 5.5 (low) vs Trinity Large Thinking (medium)

Claude Sonnet 5.5 (low) unggul dalam skor rata-rata dengan 6.2 vs 6.1. Claude Sonnet 5.5 (low) memiliki biaya benchmark lebih rendah di $0.620 vs $0.756. Claude Sonnet 5.5 (low) lebih cepat di 5.68s vs 85.44s, dengan tingkat keberhasilan 43.9% vs 48.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-29

Model yang Dibandingkan

Peringkat
#232
Total token output
28,630
Waktu respons (rata-rata)
5.68s
Total Biaya
$0.620
Peringkat
#241
Total token output
1,016,785
Waktu respons (rata-rata)
85.44s
Total Biaya
$0.756
Model yang direkomendasikan Claude Sonnet 5.5 (low)

It has the best score here (6.2), while responding about 15.1x faster than Trinity Large Thinking (medium).

Perbandingan terperinci

Metrik Claude Sonnet 5.5 Claude Sonnet 5.5 low Rilis: 2026-09-29 Trinity Large Thinking Trinity Large Thinking medium Rilis: 2026-07-28
Skor 6.2 6.1
Peringkat #232 #241
Keandalan 10.0 10.0
Konsistensi 9.4 7.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 43.9% 48.5%
Tes tidak stabil 2 6
Total Run 66 66
Biaya per hasil 6.880 9.972
Total Biaya $0.620 $0.756
Harga input $2.000 / 1M $0.250 / 1M
Harga output $10.000 / 1M $0.800 / 1M
Total token input 166,418 118,486
Token output 21,456 156,166
Token penalaran 7,174 860,619
Waktu respons (rata-rata) 5.68s 85.44s
Waktu respons (maks) 22.74s 525.14s
Waktu respons (total) 124.87s 1879.75s
Parameter ~1T total (~100B aktif) 398B total (13B aktif)
Ketersediaan Tertutup Bobot tersedia

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#232 Claude Sonnet 5.5

low
Biaya
$0.020
Waktu
15.3s
Token
2,077 tok

#241 Trinity Large Thinking

medium
Biaya
$0.016
Waktu
75.9s
Token
19,401 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155

Perbandingan Cepat

Ganti Pasangan Perbandingan