Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (high) vs KAT-Coder-Pro V2.5 (low)

KAT-Coder-Pro V2.5 (low) unggul dalam skor rata-rata dengan 6.5 vs 6.5. Mercury 2.5 (high) memiliki biaya benchmark lebih rendah di $0.044 vs $0.400. Mercury 2.5 (high) lebih cepat di 7.62s vs 19.40s, dengan tingkat keberhasilan 59.4% vs 65.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#195
Total token output
193,676
Waktu respons (rata-rata)
7.62s
Total Biaya
$0.044
Peringkat
#191
Total token output
113,193
Waktu respons (rata-rata)
19.40s
Total Biaya
$0.400
Model yang direkomendasikan Mercury 2.5 (high)

Its score stays close to the best score here (6.5 vs 6.5), while costing about 9.2x less than KAT-Coder-Pro V2.5 (low).

Perbandingan terperinci

Metrik Mercury 2.5 Mercury 2.5 high Rilis: 2026-09-08 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low Rilis: 2026-07-14
Skor 6.5 6.5
Peringkat #195 #191
Keandalan 9.8 10.0
Konsistensi 8.7 7.1
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 59.4% 65.2%
Tes tidak stabil 4 8
Total Run 69 69
Biaya per hasil 0.362 3.636
Total Biaya $0.044 $0.400
Harga input $0.040 / 1M $0.740 / 1M
Harga output $0.150 / 1M $2.960 / 1M
Total token input 358,562 87,682
Token output 4,266 7,166
Token penalaran 189,410 106,027
Waktu respons (rata-rata) 7.62s 19.40s
Waktu respons (maks) 80.30s 209.15s
Waktu respons (total) 175.36s 446.11s
Parameter ~100B ~700B total (~72B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#195 Mercury 2.5

high
Biaya
$0.001
Waktu
3.5s
Token
2,447 tok

#191 KAT-Coder-Pro V2.5

low
Biaya
$0.016
Waktu
47.6s
Token
5,182 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945

Perbandingan Cepat

Ganti Pasangan Perbandingan