Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mistral Large 4 vs GPT-5 Nano (medium)

GPT-5 Nano (medium) unggul dalam skor rata-rata dengan 5.7 vs 5.5. GPT-5 Nano (medium) memiliki biaya benchmark lebih rendah di $0.159 vs $0.353. Mistral Large 4 lebih cepat di 28.46s vs 56.55s, dengan tingkat keberhasilan 30.4% vs 53.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-06

Model yang Dibandingkan

Peringkat
#274
Total token output
84,218
Waktu respons (rata-rata)
28.46s
Total Biaya
$0.353
Peringkat
#264
Total token output
307,921
Waktu respons (rata-rata)
56.55s
Total Biaya
$0.159
Model yang direkomendasikan GPT-5 Nano (medium)

It has the best score here (5.7), while costing about 2.2x less than Mistral Large 4.

Perbandingan terperinci

Metrik Mistral Large 4 Mistral Large 4 none Rilis: 2026-10-06 GPT-5 Nano GPT-5 Nano medium Rilis: 2025-08-07
Skor 5.5 5.7
Peringkat #274 #264
Keandalan 9.9 10.0
Konsistensi 8.8 6.5
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 30.4% 53.6%
Tes tidak stabil 4 10
Total Run 69 69
Biaya per hasil 7.044 1.737
Total Biaya $0.353 $0.159
Harga input $0.680 / 1M $0.050 / 1M
Harga output $2.090 / 1M $0.400 / 1M
Harga baca cache $0.070 / 1M $0.005 / 1M
Harga tulis cache T/A T/A
Total token input 259,048 314,436
Token output 84,218 13,578
Token penalaran 0 294,343
Waktu respons (rata-rata) 28.46s 56.55s
Waktu respons (maks) 385.10s 227.89s
Waktu respons (total) 654.47s 961.32s
Parameter 1.05T total (49B aktif) ~120B total (~5B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#274 Mistral Large 4

none
Biaya
$0.004
Waktu
26.7s
Token
1,923 tok

#264 GPT-5 Nano

medium
Biaya
$0.006
Waktu
108.5s
Token
13,209 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Mistral Large 4 5.4 7.8 22.2% 1 153.02s 7,431 62,517 0
GPT-5 Nano 7.0 7.7 55.6% 1 41.62s 7,305 740 41,152

Perbandingan Cepat

Ganti Pasangan Perbandingan