Navigasi
Advertise here

Claude Sonnet 5 (medium) vs Gemini 3.1 Pro Preview (medium)

Claude Sonnet 5 (medium) unggul dalam skor rata-rata dengan 8.5 vs 8.4. Claude Sonnet 5 (medium) memiliki biaya benchmark lebih rendah di $1.438 vs $1.585. Claude Sonnet 5 (medium) lebih cepat di 15.01s vs 22.71s, dengan tingkat keberhasilan 76.8% vs 89.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-02

Model yang Dibandingkan

Peringkat
#66
Total token output
73,261
Waktu respons (rata-rata)
15.01s
Total Biaya
$1.438
Peringkat
#71
Total token output
102,691
Waktu respons (rata-rata)
22.71s
Total Biaya
$1.585
Model yang direkomendasikan Claude Sonnet 5 (medium)

It has the best score here (8.5), while responding about 1.5x faster than Gemini 3.1 Pro Preview (medium).

Perbandingan terperinci

Metrik Claude Sonnet 5 Claude Sonnet 5 medium Rilis: 2026-06-30 Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium Rilis: 2026-02-19
Skor 8.5 8.4
Peringkat #66 #71
Keandalan 10.0 9.8
Konsistensi 9.1 9.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 76.8% 89.9%
Tes tidak stabil 3 1
Total Run 69 69
Biaya per hasil 8.985 7.924
Total Biaya $1.438 $1.585
Harga input $2.000 / 1M $2.000 / 1M
Harga output $10.000 / 1M $12.000 / 1M
Harga baca cache $0.200 / 1M $0.200 / 1M
Harga tulis cache $2.500 / 1M $0.375 / 1M
Total token input 353,658 176,208
Token output 54,891 6,093
Token penalaran 18,370 96,598
Waktu respons (rata-rata) 15.01s 22.71s
Waktu respons (maks) 69.26s 88.68s
Waktu respons (total) 345.16s 386.11s
Parameter ~1T total (~100B aktif) ~1.2T total (~20B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#66 Claude Sonnet 5

medium
Biaya
$0.007
Waktu
6.4s
Token
832 tok

#71 Gemini 3.1 Pro Preview

medium
Biaya
$0.115
Waktu
87.2s
Token
9,629 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Sonnet 5 9.0 7.9 88.9% 1 17.28s 10,590 13,153 2,379
Gemini 3.1 Pro Preview 7.9 9.9 66.7% 0 40.17s 8,124 435 41,247

Perbandingan Cepat

Ganti Pasangan Perbandingan