Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 Chat vs Qwen3.8 2.4T A95B (low)

Qwen3.8 2.4T A95B (low) unggul dalam skor rata-rata dengan 8.2 vs 8.0. GPT-5.2 Chat memiliki biaya benchmark lebih rendah di $0.604 vs $3.113. GPT-5.2 Chat lebih cepat di 7.65s vs 132.39s, dengan tingkat keberhasilan 74.2% vs 78.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-12

Peringkat
#51
Total token output
30,424
Waktu respons (rata-rata)
7.65s
Total Biaya
$0.604
Peringkat
#46
Total token output
554,485
Waktu respons (rata-rata)
132.39s
Total Biaya
$3.113
Model yang direkomendasikan GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.2), while costing about 5.2x less than Qwen3.8 2.4T A95B (low).

Perbandingan terperinci

Metrik GPT-5.2 Chat GPT-5.2 Chat none Rilis: 2025-12-11 Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B low Rilis: 2026-08-12
Skor 8.0 8.2
Peringkat #51 #46
Keandalan 10.0 9.1
Konsistensi 8.6 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 74.2% 78.8%
Tes tidak stabil 4 3
Total Run 66 66
Biaya per hasil 4.308 19.453
Total Biaya $0.604 $3.113
Harga input $1.750 / 1M $2.000 / 1M
Harga output $14.000 / 1M $6.000 / 1M
Total token input 101,248 113,340
Token output 30,424 107,311
Token penalaran 0 447,174
Waktu respons (rata-rata) 7.65s 132.39s
Waktu respons (maks) 38.52s 534.21s
Waktu respons (total) 168.39s 2912.56s
Parameter ~400B total (~17B aktif) 2.4T total (95B aktif)
Ketersediaan Tertutup Bobot tersedia

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 GPT-5.2 Chat

none
Biaya
$0.010
Waktu
15.3s
Token
797 tok

#46 Qwen3.8 2.4T A95B

low
Biaya
$0.100
Waktu
193.2s
Token
16,767 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0
Qwen3.8 2.4T A95B 7.6 7.2 77.8% 1 172.53s 6,716 21,405 57,399

Perbandingan Cepat

Ganti Pasangan Perbandingan