Navigasi
AI BENCHY
Advertise here

Trinity Large Thinking (medium) vs Seed-2.0-Lite

Seed-2.0-Lite unggul dalam skor rata-rata dengan 6.2 vs 6.1. Seed-2.0-Lite memiliki biaya benchmark lebih rendah di $0.066 vs $0.798. Seed-2.0-Lite lebih cepat di 4.37s vs 85.44s, dengan tingkat keberhasilan 48.5% vs 40.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-15

Peringkat
#174
Total token output
1,016,785
Waktu respons (rata-rata)
85.44s
Total Biaya
$0.798
Peringkat
#163
Total token output
14,744
Waktu respons (rata-rata)
4.37s
Total Biaya
$0.066
Model yang direkomendasikan Seed-2.0-Lite

It has the best score here (6.2), while costing about 12.3x less than Trinity Large Thinking (medium).

Perbandingan terperinci

Metrik Trinity Large Thinking Trinity Large Thinking medium Rilis: 2026-07-28 Seed-2.0-Lite Seed-2.0-Lite none Rilis: 2026-02-14
Skor 6.1 6.2
Peringkat #174 #163
Keandalan 10.0 10.0
Konsistensi 7.9 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 48.5% 40.9%
Tes tidak stabil 6 3
Total Run 66 66
Biaya per hasil 9.972 0.813
Total Biaya $0.798 $0.066
Harga input $0.220 / 1M $0.250 / 1M
Harga output $0.850 / 1M $2.000 / 1M
Total token input 118,486 142,206
Token output 156,166 14,744
Token penalaran 860,619 0
Waktu respons (rata-rata) 85.44s 4.37s
Waktu respons (maks) 525.14s 44.58s
Waktu respons (total) 1879.75s 96.20s
Parameter 398B total (13B aktif) ~200B total (~20B aktif)
Ketersediaan Bobot tersedia Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#174 Trinity Large Thinking

medium
Biaya
$0.016
Waktu
75.9s
Token
19,401 tok

#163 Seed-2.0-Lite

none
Biaya
$0.005
Waktu
83.8s
Token
2,311 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Trinity Large Thinking 7.5 10.0 66.7% 0 179.02s 7,248 7,413 351,155
Seed-2.0-Lite 5.6 10.0 33.3% 0 2.83s 8,215 410 0

Perbandingan Cepat

Ganti Pasangan Perbandingan