Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Small 4 (medium) vs Laguna S 2.1 (low)

Mistral Small 4 (medium) unggul dalam skor rata-rata dengan 5.1 vs 5.0. Laguna S 2.1 (low) memiliki biaya benchmark lebih rendah di $0.082 vs $0.097. Mistral Small 4 (medium) lebih cepat di 10.80s vs 85.34s, dengan tingkat keberhasilan 43.9% vs 22.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-04

Peringkat
#257
Total token output
133,597
Waktu respons (rata-rata)
10.80s
Total Biaya
$0.097
Peringkat
#266
Total token output
451,708
Waktu respons (rata-rata)
85.34s
Total Biaya
$0.082
Model yang direkomendasikan Mistral Small 4 (medium)

It has the best score here (5.1), while responding about 7.9x faster than Laguna S 2.1 (low).

Perbandingan terperinci

Metrik Mistral Small 4 Mistral Small 4 medium Rilis: 2026-03-16 Laguna S 2.1 Laguna S 2.1 low Rilis: 2026-07-21 Tersedia gratis
Skor 5.1 5.0
Peringkat #257 #266
Keandalan 10.0 10.0
Konsistensi 7.0 8.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 43.9% 22.7%
Tes tidak stabil 8 5
Total Run 66 66
Biaya per hasil 1.923 3.022
Total Biaya $0.097 $0.082
Harga input $0.150 / 1M $0.090 / 1M
Harga output $0.600 / 1M $0.180 / 1M
Total token input 140,559 118,752
Token output 40,268 67,823
Token penalaran 93,329 383,885
Waktu respons (rata-rata) 10.80s 85.34s
Waktu respons (maks) 59.15s 814.73s
Waktu respons (total) 237.60s 1877.49s
Parameter 119B total (6B aktif) 118B total (8B aktif)
Ketersediaan Sumber terbuka Bobot tersedia

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#257 Mistral Small 4

medium
Biaya
$0.006
Waktu
47.9s
Token
9,857 tok

#266 Laguna S 2.1

low
Biaya
$0.001
Waktu
6.6s
Token
1,314 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Mistral Small 4 4.4 5.1 33.3% 2 39.98s 7,636 11,635 54,715
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

Perbandingan Cepat

Ganti Pasangan Perbandingan