Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (high) vs Laguna XS 2.1 (medium)

Skor rata-rata hampir imbang di 6.5 vs 6.4. Mercury 2.5 (high) memiliki biaya benchmark lebih rendah di $0.044 vs $0.083. Mercury 2.5 (high) lebih cepat di 7.62s vs 48.97s, dengan tingkat keberhasilan 59.4% vs 46.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#194
Total token output
193,676
Waktu respons (rata-rata)
7.62s
Total Biaya
$0.044
Peringkat
#200
Total token output
538,292
Waktu respons (rata-rata)
48.97s
Total Biaya
$0.083
Model yang direkomendasikan Mercury 2.5 (high)

It has the best score here (6.5), while costing about 1.9x less than Laguna XS 2.1 (medium).

Perbandingan terperinci

Metrik Mercury 2.5 Mercury 2.5 high Rilis: 2026-09-08 Laguna XS 2.1 Laguna XS 2.1 medium Rilis: 2026-07-02 Tersedia gratis
Skor 6.5 6.4
Peringkat #194 #200
Keandalan 9.8 10.0
Konsistensi 8.7 9.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 59.4% 46.4%
Tes tidak stabil 4 3
Total Run 69 69
Biaya per hasil 0.362 0.922
Total Biaya $0.044 $0.083
Harga input $0.040 / 1M $0.060 / 1M
Harga output $0.150 / 1M $0.120 / 1M
Total token input 358,562 352,516
Token output 4,266 33,786
Token penalaran 189,410 504,506
Waktu respons (rata-rata) 7.62s 48.97s
Waktu respons (maks) 80.30s 422.72s
Waktu respons (total) 175.36s 1126.35s
Parameter ~100B 33B total (3B aktif)
Ketersediaan Tertutup Bobot tersedia

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#194 Mercury 2.5

high
Biaya
$0.001
Waktu
3.5s
Token
2,447 tok

#200 Laguna XS 2.1

medium
Biaya
$0.001
Waktu
30.6s
Token
4,678 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
Laguna XS 2.1 5.5 10.0 33.3% 0 70.35s 7,995 23,767 83,258

Perbandingan Cepat

Ganti Pasangan Perbandingan