Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-5.2 (medium) vs Grok 4.5 (medium)

Grok 4.5 (medium) unggul dalam skor rata-rata dengan 8.5 vs 8.4. GPT-5.2 (medium) memiliki biaya benchmark lebih rendah di $1.182 vs $2.042. GPT-5.2 (medium) lebih cepat di 28.51s vs 68.59s, dengan tingkat keberhasilan 72.7% vs 83.3%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-23

Model yang Dibandingkan

Peringkat
#64
Total token output
71,252
Waktu respons (rata-rata)
28.51s
Total Biaya
$1.182
Peringkat
#60
Total token output
299,460
Waktu respons (rata-rata)
68.59s
Total Biaya
$2.042
Model yang direkomendasikan GPT-5.2 (medium)

Its score stays close to the best score here (8.4 vs 8.5), while costing about 1.7x less than Grok 4.5 (medium).

Perbandingan terperinci

Metrik GPT-5.2 GPT-5.2 medium Rilis: 2025-12-11 Grok 4.5 Grok 4.5 medium Rilis: 2026-07-08
Skor 8.4 8.5
Peringkat #64 #60
Keandalan 10.0 10.0
Konsistensi 8.5 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 72.7% 83.3%
Tes tidak stabil 4 3
Total Run 66 66
Biaya per hasil 8.438 12.007
Total Biaya $1.182 $2.042
Harga input $1.750 / 1M $2.000 / 1M
Harga output $14.000 / 1M $6.000 / 1M
Total token input 105,013 122,155
Token output 9,914 5,514
Token penalaran 61,338 293,946
Waktu respons (rata-rata) 28.51s 68.59s
Waktu respons (maks) 116.86s 436.38s
Waktu respons (total) 456.13s 1508.91s
Parameter ~1.2T total (~80B aktif) ~1.7T total (~170B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#64 GPT-5.2

medium
Biaya
$0.047
Waktu
49.2s
Token
3,396 tok

#60 SpaceXAI: Grok 4.5

medium
Biaya
$0.044
Waktu
59.4s
Token
7,512 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

Perbandingan Cepat

Ganti Pasangan Perbandingan