Navigasi
AI BENCHY
Advertise here

Claude Opus 4.8 vs Qwen3.7 Plus

Claude Opus 4.8 unggul dalam skor rata-rata dengan 7.3 vs 7.2. Qwen3.7 Plus memiliki biaya benchmark lebih rendah di $0.106 vs $1.166. Claude Opus 4.8 lebih cepat di 4.91s vs 12.09s, dengan tingkat keberhasilan 63.6% vs 50.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Peringkat
#74
Total token output
16,797
Waktu respons (rata-rata)
4.91s
Total Biaya
$1.166
Peringkat
#79
Total token output
58,097
Waktu respons (rata-rata)
12.09s
Total Biaya
$0.106
Model yang direkomendasikan Qwen3.7 Plus

Its score stays close to the best score here (7.2 vs 7.3), while costing about 11.0x less than Claude Opus 4.8.

Perbandingan terperinci

Metrik Claude Opus 4.8 Claude Opus 4.8 none Rilis: 2026-05-28 Qwen3.7 Plus Qwen3.7 Plus none Rilis: 2026-06-03
Skor 7.3 7.2
Peringkat #74 #79
Keandalan 10.0 10.0
Konsistensi 9.2 10.0
Tes benar
Tingkat lulus per percobaan 63.6% 50.0%
Tes tidak stabil 2 0
Total Run 66 66
Biaya per hasil 8.969 1.014
Total Biaya $1.166 $0.106
Harga input $5.000 / 1M $0.320 / 1M
Harga output $25.000 / 1M $1.280 / 1M
Total token input 149,206 98,824
Token output 16,797 58,097
Token penalaran 0 0
Waktu respons (rata-rata) 4.91s 12.09s
Waktu respons (maks) 35.03s 206.03s
Waktu respons (total) 108.03s 265.89s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#74 Claude Opus 4.8

none
Biaya
$0.053
Waktu
22.0s
Token
2,253 tok

#79 Qwen3.7 Plus

none
Biaya
$0.019
Waktu
213.5s
Token
11,960 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Opus 4.8 5.5 10.0 33.3% 0 3.29s 10,590 1,332 0
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0

Perbandingan Cepat

Ganti Pasangan Perbandingan