Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (medium) vs KAT-Coder-Pro V2.5

Skor rata-rata hampir imbang di 6.8 vs 6.7. Mercury 2.5 (medium) memiliki biaya benchmark lebih rendah di $0.022 vs $0.487. Mercury 2.5 (medium) lebih cepat di 3.19s vs 26.01s, dengan tingkat keberhasilan 65.2% vs 71.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-08

Model yang Dibandingkan

Peringkat
#157
Total token output
120,129
Waktu respons (rata-rata)
3.19s
Total Biaya
$0.022
Peringkat
#161
Total token output
139,572
Waktu respons (rata-rata)
26.01s
Total Biaya
$0.487
Model yang direkomendasikan Mercury 2.5 (medium)

It has the best score here (6.8), while costing about 22.4x less than KAT-Coder-Pro V2.5.

Perbandingan terperinci

Metrik Mercury 2.5 Mercury 2.5 medium Rilis: 2026-09-08 KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none Rilis: 2026-07-14
Skor 6.8 6.7
Peringkat #157 #161
Keandalan 9.8 10.0
Konsistensi 8.6 7.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 65.2% 71.2%
Tes tidak stabil 4 8
Total Run 66 66
Biaya per hasil 0.181 4.419
Total Biaya $0.022 $0.487
Harga input $0.040 / 1M $0.740 / 1M
Harga output $0.150 / 1M $2.960 / 1M
Total token input 91,402 98,508
Token output 3,138 139,572
Token penalaran 116,991 0
Waktu respons (rata-rata) 3.19s 26.01s
Waktu respons (maks) 9.87s 335.41s
Waktu respons (total) 70.18s 572.22s
Parameter ~100B ~700B total (~72B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Mercury 2.5

medium
Biaya
$0.001
Waktu
3.8s
Token
3,386 tok

#161 KAT-Coder-Pro V2.5

none
Biaya
$0.010
Waktu
29.0s
Token
3,439 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0

Perbandingan Cepat

Ganti Pasangan Perbandingan