Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT-6 Luna (high) vs Grok 4.5 (low)

Grok 4.5 (low) unggul dalam skor rata-rata dengan 7.8 vs 7.7. GPT-6 Luna (high) memiliki biaya benchmark lebih rendah di $0.074 vs $1.345. Grok 4.5 (low) lebih cepat di 18.14s vs 20.37s, dengan tingkat keberhasilan 73.9% vs 73.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#111
Total token output
101,587
Waktu respons (rata-rata)
20.37s
Total Biaya
$0.074
Peringkat
#109
Total token output
121,415
Waktu respons (rata-rata)
18.14s
Total Biaya
$1.345
Model yang direkomendasikan GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 18.2x less than Grok 4.5 (low).

Perbandingan terperinci

Metrik GPT-6 Luna GPT-6 Luna high Rilis: 2026-09-23 Grok 4.5 Grok 4.5 low Rilis: 2026-07-08
Skor 7.7 7.8
Peringkat #111 #109
Keandalan 10.0 10.0
Konsistensi 8.7 9.3
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 73.9% 73.9%
Tes tidak stabil 4 2
Total Run 69 69
Biaya per hasil 0.492 8.404
Total Biaya $0.074 $1.345
Harga input $0.100 / 1M $2.000 / 1M
Harga output $0.500 / 1M $6.000 / 1M
Total token input 229,986 308,068
Token output 6,037 9,218
Token penalaran 95,550 112,197
Waktu respons (rata-rata) 20.37s 18.14s
Waktu respons (maks) 106.93s 205.28s
Waktu respons (total) 468.52s 417.21s
Parameter ~400B total (~17B aktif) ~1.7T total (~170B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 GPT-6 Luna

high
Biaya
$0.003
Waktu
49.2s
Token
5,231 tok

#109 SpaceXAI: Grok 4.5

low
Biaya
$0.011
Waktu
12.4s
Token
2,018 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

Perbandingan Cepat

Ganti Pasangan Perbandingan