Navigasi
Advertise here

GPT-5.4 (medium) vs Qwen3.8 27B (high)

GPT-5.4 (medium) unggul dalam skor rata-rata dengan 8.8 vs 8.7. Qwen3.8 27B (high) memiliki biaya benchmark lebih rendah di ~$0.298 vs $2.006. GPT-5.4 (medium) lebih cepat di 24.81s vs 166.34s, dengan tingkat keberhasilan 78.3% vs 78.3%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#50
Total token output
96,502
Waktu respons (rata-rata)
24.81s
Total Biaya
$2.006
Peringkat
#55
Total token output
677,080
Waktu respons (rata-rata)
166.34s
Total Biaya
~$0.298
Model yang direkomendasikan Qwen3.8 27B (high)

Its score stays close to the best score here (8.7 vs 8.8), while costing about 6.7x less than GPT-5.4 (medium).

Perbandingan terperinci

Metrik GPT-5.4 GPT-5.4 medium Rilis: 2026-03-05 Qwen3.8 27B Qwen3.8 27B high Rilis: 2026-08-14 Tersedia gratis
Skor 8.8 8.7
Peringkat #50 #55
Keandalan 10.0 9.7
Konsistensi 8.7 9.2
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 78.3% 78.3%
Tes tidak stabil 4 2
Total Run 69 69
Biaya per hasil 12.535 ~1.751
Total Biaya $2.006 ~$0.298
Harga input $2.500 / 1M T/A
Harga output $15.000 / 1M T/A
Total token input 223,210 348,967
Token output 7,312 1,005
Token penalaran 89,190 676,075
Waktu respons (rata-rata) 24.81s 166.34s
Waktu respons (maks) 100.41s 640.85s
Waktu respons (total) 570.60s 3825.81s
Parameter ~1.5T total (~100B aktif) 27.3B
Ketersediaan Tertutup Bobot tersedia

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 GPT-5.4

medium
Biaya
$0.214
Waktu
199.6s
Token
14,349 tok

#55 Qwen3.8 27B

high
Biaya
~$0.008
Waktu
270.1s
Token
18,963 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

Perbandingan Cepat

Ganti Pasangan Perbandingan

GPT-5.2mediumvsQwen3.8 27BhighTersedia gratisQwen3.8 27BhighTersedia gratisvsMiMo-V2.6-PromediumSeed 2.1 TurbomediumvsQwen3.8 27BhighTersedia gratisGPT-6 SollowvsQwen3.8 27BhighTersedia gratisGPT-5.4mediumvsQwen3.8 MAXlowDeepSeek V4.1 FlashhighvsGPT-5.4mediumDeepSeek V4.1 FlashmaxvsQwen3.8 27BhighTersedia gratisMuse Spark 1.2lowvsQwen3.8 27BhighTersedia gratisMuse Spark 1.2lowvsGPT-5.4mediumDeepSeek V4.1 FlashmediumvsQwen3.8 27BhighTersedia gratisMuse Spark 1.1lowvsQwen3.8 27BhighTersedia gratisClaude Sonnet 5.5xhighvsQwen3.8 27BhighTersedia gratis