Navigasi
AI BENCHY
Advertise here

Qwen: Qwen3.7 Plus vs xAI: Grok 4.5

Grok 4.5 (medium) unggul dalam skor rata-rata dengan 8.3 vs 7.9. Qwen3.7 Plus (medium) memiliki biaya benchmark lebih rendah di $0.267 vs $1.928. Qwen3.7 Plus (medium) lebih cepat di 51.51s vs 61.71s, dengan tingkat keberhasilan 75.8% vs 78.8%.

Model yang direkomendasikanQwen3.7 Plus (medium)Its score stays close to the best score here (7.9 vs 8.3), while costing about 7.2x less than Grok 4.5 (medium).

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Metrik Qwen3.7 Plus Qwen3.7 Plus medium Rilis: 2026-06-03 Grok 4.5 Grok 4.5 medium Rilis: 2026-07-08
Skor 7.9 8.3
Peringkat #43 #28
Keandalan 10.0 10.0
Konsistensi 8.9 8.9
Tes benar
Tingkat lulus per percobaan 75.8% 78.8%
Tes tidak stabil 3 3
Total Run 66 66
Biaya per hasil 2.072 12.049
Total Biaya $0.267 $1.928
Harga input $0.320 / 1M $2.000 / 1M
Harga output $1.280 / 1M $6.000 / 1M
Total token input 115,233 122,146
Token output 6,162 5,514
Token penalaran 173,267 275,053
Waktu respons (rata-rata) 51.51s 61.71s
Waktu respons (maks) 315.30s 436.38s
Waktu respons (total) 1133.15s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#43 Qwen3.7 Plus

medium
Biaya
$0.018
Waktu
193.2s
Token
10,821 tok

#28 xAI: Grok 4.5

medium
Biaya
$0.044
Waktu
59.4s
Token
7,512 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

Perbandingan Cepat

Ganti Pasangan Perbandingan